TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM Paper • 2607.27205 • Published 29 days ago • 140
TableVerse: A Large-scale Tabletop Dataset with Real-world Grounded Layouts for Generalizable Manipulation Paper • 2607.21017 • Published Jul 23 • 8
Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning Paper • 2607.02963 • Published Jul 3 • 29
Embodied-R1.5: Evolving Physical Intelligence via Embodied Foundation Models Paper • 2606.11324 • Published Jun 9 • 172
Thinking Before Constraining: A Unified Decoding Framework for Large Language Models Paper • 2601.07525 • Published May 28 • 10
electricsheepafrica/africa-owid-equal-authority-over-assets-during-marriage Viewer • Updated 14 days ago • 2.92k • 36 • 1
Zero-Shot Sim-to-Real Robot Learning: A Dexterous Manipulation Study on Reactive Catching Paper • 2605.09789 • Published May 10 • 6