TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM Paper • 2607.27205 • Published 4 days ago • 127
AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report Paper • 2607.18367 • Published 13 days ago • 59
BadWAM: When World-Action Models Dream Right but Act Wrong Paper • 2607.15207 • Published 17 days ago • 53
RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation Paper • 2607.06559 • Published 26 days ago • 95
ABot-N1: Toward a General Visual Language Navigation Foundation Model Paper • 2607.10383 • Published 19 days ago • 102
Scalable Visual Pretraining for Language Intelligence Paper • 2607.09657 • Published 23 days ago • 57
AlayaWorld: Long-Horizon and Playable Video World Generation Paper • 2607.06291 • Published 26 days ago • 91
EVA-Client: A Unified Data Collection, Inference, and Deployment Framework for Embodied Policies on Real Robots Paper • 2607.02646 • Published Jul 2 • 27
AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents Paper • 2607.02255 • Published Jul 2 • 67
Seed2.0 Model Card: Towards Intelligence Frontier for Real-World Complexity Paper • 2607.00248 • Published Jun 30 • 32