1

MolmoAct 2: An open foundation for robots that work in the real world
Open action-reasoning robotics foundation model for real-world deployment
SeeTraceAct: Visibility-Aware Latent Planning from Cross-Embodiment Demonstration Videos
A demo-conditioned VLA that grounds one-shot demonstrations via visibility-aware future-trace prediction
Imaginative Perception Tokens Enhance Spatial Reasoning in Multimodal Language Models
Imaginative Perception Tokens enhance spatial reasoning in multimodal language models - ECCV 2026