具身智能

Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation

2026-06-14arxiv.org

Qwen-RobotWorld 技术报告提出通过语言条件视频生成实现具身世界建模。

值得记下

将语言指令直接映射为具身环境的视频级动态建模,跳过显式状态表征环节。

阅读原文

内容来源:arxiv.org,版权归原作者所有