XuanyuanTechnologyReview
26-06-17 16:38

阿里通义发布Qwen-Robot
6月16日,通义实验室发文宣布正式推出 Qwen-Robot,要打通大模型到物理世界的最后一公里。它包含三个基础模型。
Qwen-RobotNav:物理智能体的行动入口
通过自适应的视觉分配策略和工具接口,把视觉语言能力接入移动控制,统一了指令跟随、点/目标导航、目标追踪和自动驾驶四类任务。
Qwen-RobotManip:物理智能体的交互基石
通过规范状态-动作空间和相机坐标系下的末端执行器增量位姿,把视觉语言能力接入操作控制,基于完全由开源数据构建的 >38,100 小时操作数据实现了大规模多机型训练。
Qwen-RobotWorld:物理智能体的无限世界
通过自然语言动作接口,把视觉语言能力接入世界动力学预测,让同一个世界模型能够跨操作、驾驶和导航场景预测符合物理规律的未来。

发布于 北京