Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 4 days ago • 362
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments Paper • 2605.30280 • Published May 28 • 148
CodePercept: Code-Grounded Visual STEM Perception for MLLMs Paper • 2603.10757 • Published Mar 11 • 15