阿里发布千问具身智能大模型
来源:龙灵发布时间:2026-06-18505浏览
询问 AI
近日,阿里巴巴正式推出了千问具身智能(Embodied Intelligence)大模型Qwen-Robot系列。该系列旨在提升机器人的环境理解与运动控制能力,目前部分阿里云企业客户已率先开展部署与测试工作。
据南华早报报道,具身智能正成为全球人工智能领域的重要发展方向。在此背景下,谷歌DeepMind不断优化Gemini Robotics系列模型,英伟达则依托Cosmos、Isaac及GR00T等平台打造物理AI生态系统。同时,腾讯、宇树科技和智元机器人等中国科技企业也在加快相关业务的布局步伐。
此次发布的Qwen-Robot系列包含三款针对不同智能层级的模型,支持独立或协同部署。其中,视觉-语言-动作(VLA)模型Qwen-RobotManip采用了80维度的统一动作表征技术。该技术使同一模型能够适配多种硬件结构的机器人,免去了针对特定平台重新训练的步骤。其操作指令基于摄像头画面的相对位置生成,有效提高了跨平台迁移的效率。
导航模型Qwen-RobotNav将语言指令导航、目标搜索以及自动驾驶等五项任务融合于统一架构中。该模型引入了任务自适应观察机制,能够根据具体任务类型动态调整记忆策略,从而解决了传统导航模型在处理不同任务时难以灵活筛选环境信息的问题。
此外,世界模型Qwen-RobotWorld赋予了机器人理解物理规律的能力。它可以在执行动作前预先模拟运动轨迹,并自动生成用于训练的视频数据,这在一定程度上缓解了具身智能领域训练数据匮乏的难题。
此前,千问系列主要聚焦于大型语言模型和多模态模型,在国际市场上与OpenAI和谷歌展开竞争,在国内则与DeepSeek、字节跳动等企业角逐。此次Qwen-Robot系列的发布,标志着千问系列的技术能力首次从数字领域拓展至物理世界。
新闻来源:龙灵,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

