2026年6月16日,阿里巴巴发布了Qwen Robot系列,这是其首个专为机器人打造的、完整的具身智能基础模型家族 [2][3][4]。 该套件包含三大核心模型:Qwen RobotManip(VLA操作模型),赋予机器人感知环境、理解语言指令并执行如抓取等物理动作的能力 [2][8]。
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Alibaba launch with its Qwen Robot Suite, and what does it signify about the company's push into embodied AI?. Article summary: On June 16, 2026, Alibaba launched the **Qwen Robot Suite** (also called the Qwen-Robot series), its first complete family of embodied AI foundation models purpose-built for robots. The suite consists of three core model. Topic tags: general, news, general web, user generated, academic. Reference image context from search candidates: Reference image 1: visual subject "Alibaba Group has rolled out a suite of artificial-intelligence models that can help robots better understand and perform real-world tasks, as tech companies ramp up a push into th" source context "Alibaba Launches Robotics AI Models as It Ramps Up Physical AI ..." Reference image 2: visual subject "Alibaba's Qwen Team
人工智能的竞赛正从屏幕里的对话框,迅速蔓延到我们身边的物理世界。2026年6月16日,阿里巴巴投下了一枚重磅炸弹,正式发布了其首个完整的具身智能大模型系列——Qwen-Robot(通义千问具身智能大模型系列)。这不仅是技术上的一次秀肌肉,更清晰地揭示了这家科技巨头未来的战略航向。
简单来说,阿里为机器人打造了一套完整的“手、脚、脑”通用底座,该套件包含三个核心模型:
从“数字大脑”到“物理身体”的跨界:阿里此举最核心的意义在于,它正将其王牌产品——通义千问大模型的强大能力,从纯数字领域(聊天、写代码)系统性地迁移到物理世界。这标志着阿里正式从软件AI,跨入了能让机器在现实世界中感知、操作和行动的“具身智能”新战场。
有条不紊的战略布局迎来成果:这次的发布并非心血来潮。早在2025年10月,阿里通义千问负责人林俊旸就已组建了一个内部的机器人和具身智能团队。从2026年6月初开始,阿里便陆续发布了如RynnBrain等相关的开源具身模型
。Qwen-Robot系列的推出,正是这一年多来内部战略推进和资源整合的集大成者。
要做机器人的“通用大脑”,而非仅仅制造一种“身体”:这个套件的设计理念非常开放——它们可以独立部署,也能协同工作,并适配各种不同形态的机器人。这意味着阿里的目标可能不仅仅是造一台“阿里机器人”,而是成为具身智能时代的“平台提供商”和“技术底座”,为千行百业的机器人供应最核心的“大脑”,如同安卓系统之于手机行业。
在全球科技巨头(如特斯拉、谷歌DeepMind等)纷纷重注押宝物理AI的背景下,阿里巴巴携Qwen-Robot系列高调入场,让这场决定未来人机交互形态的竞赛,变得更加激烈也更加精彩。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
2026年6月16日,阿里巴巴发布了Qwen Robot系列,这是其首个专为机器人打造的、完整的具身智能基础模型家族 [2][3][4]。
2026年6月16日,阿里巴巴发布了Qwen Robot系列,这是其首个专为机器人打造的、完整的具身智能基础模型家族 [2][3][4]。 该套件包含三大核心模型:Qwen RobotManip(VLA操作模型),赋予机器人感知环境、理解语言指令并执行如抓取等物理动作的能力 [2][8]。
Qwen RobotNav(VLN导航模型),让机器人能通过理解视觉线索和语言指令,在现实空间中自主移动 [2][8]。