Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation Paper • 2609.08084 • Published 5 days ago • 59
aDSL: Agentic 3D Creation via Joint Agent-Program Design Paper • 2608.17975 • Published 26 days ago • 7
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation Paper • 2608.30396 • Published 13 days ago • 12
Agentic Visual Generation: From Generative Models to Agentic Control Paper • 2609.06758 • Published 7 days ago • 30
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model Paper • 2609.09158 • Published 5 days ago • 22
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 13 days ago • 383
SolarWM: Open Data and Scalable Training for Long-Horizon Video World Models Paper • 2609.02886 • Published 11 days ago • 149
Scal3R: Learning Efficient Multi-Relative Pose Query for Scalable Online 3D Reconstruction Paper • 2609.04201 • Published 10 days ago • 49
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation Paper • 2608.30935 • Published 13 days ago • 32
Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling Paper • 2608.30821 • Published 13 days ago • 120
Code as Worlds: Agentic Discovery of Executable World Representations for Physical Reasoning Paper • 2608.27549 • Published 17 days ago • 53
Locate Anything in Videos: Rethinking Efficient Generative Spatio-Temporal Video Grounding Paper • 2608.28192 • Published 16 days ago • 19
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 Paper • 2608.27370 • Published 17 days ago • 40
Revisiting Local Context for Long-Horizon Streaming 3D Reconstruction Paper • 2608.27529 • Published 17 days ago • 33
Zetta ζ: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence Paper • 2608.16590 • Published 27 days ago • 150
EnvHarness: Awakening Static Worlds for Agent Learning Paper • 2608.19880 • Published 24 days ago • 275
Block3D: Efficient Text-to-3D Generation via Block-Wise Diffusion Paper • 2608.19567 • Published 24 days ago • 33