阿里巴巴推出Qwen机器人系列,搭载三款具身大型模型,旨在解决异构机器人的适配问题

\'阿里巴巴推出Qwen机器人系列,搭载三款具身大型模型,旨在解决异构机器人的适配问题\'

6月16日,阿里巴巴发布了Qwen-Robot系列具身智能模型,该系列由三个核心组件构成:用于操作控制的VLA模型Qwen-RobotManip、用于导航的VLN模型Qwen-RobotNav,以及用于构建世界模型的Qwen-RobotWorld。这一战略性的产品发布体现了各大科技企业对具身智能基础模型更坚定的投入,有助于实现机器人控制、导航功能与物理推理之间的无缝协同。

为解决传统VLA模型在面对硬件或场景变化时表现不佳的行业痛点,Qwen-RobotManip引入了80维的统一动作表示方式,为各类硬件定义了一套通用的“肢体语言”,仅需少量反馈步骤即可实现不同设备间的自动适配。而专为导航与任务执行设计的VLN模型Qwen-RobotNav则是在Qwen-VL的基础上发展而来,它首次将包括语言引导导航、目标搜索以及自动驾驶在内的五类任务整合到同一框架中,从而消除了在复杂任务中切换模型的需求。

作为系统的认知核心,Qwen-RobotWorld使系统具备对物理世界进行推理的能力,能够预测并模拟后续的动作与状态。目前具身智能正从单一场景应用向通用化应用过渡。随着这三款模型同步发布,阿里巴巴通过解耦技术架构并整合多模态能力,有望加速异构机器人的实际部署进程。