小米玄戒 O100 原型机运行自家的 MiMo 端侧模型时,实测推理速度达到每秒 295 tokens,但它是技术验证设备,并非量产手机。 Xiaomi AI Cube 原型机将同一套端侧 AI 思路扩展到迷你主机,采用三颗玄戒芯片、80GB 统一内存和最高 150W 的持续性能释放,可运行 120B 与 3B 模型。
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Xiaomi president Lu Weibing reveal on August 25, 2026, about the Xuanjie O100 prototype—an ultra-high-speed on-device AI terminal t. Article summary: Lu Weibing presented the Xuanjie O100 prototype as a purpose-built demonstration of phone-class, on-device large-model inference—not a conventional consumer handset. Its design sacrifices the rear-camera system for dual-. Topic tags: general, education, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, cha
小米这次展示的玄戒 O100 原型机,重点并不是“做了一部新手机”,而是回答一个更现实的问题:如果要让大模型在手机本地持续高速运行,手机硬件需要牺牲什么?
8 月 25 日,小米集团合伙人、总裁兼手机部总裁卢伟冰公开了这款原型设备。它采用玄戒 O3 手机处理器与玄戒 O100 高带宽 AI 加速芯片协同计算,取消传统后置影像模组,重新设计主板,并加入最高支持 10 瓦散热能力的主动风冷系统。运行小米 MiMo 端侧模型时,小米公布的实测推理速度为每秒 295 tokens。 3
7
不过,这个数字应被看作特定原型机运行特定模型时的小米测试结果,并不代表所有模型或未来搭载 O100 的设备都能达到同样速度。更重要的是,O100 原型机目前是技术验证终端,而不是已经公布售价和上市时间的消费级手机。 3
这款设备围绕一个目标设计:在终端侧持续、高速地运行大模型。它没有把 AI 当作传统影像手机中的一个附加功能,而是直接为推理性能重排硬件优先级:
为了容纳这套双芯方案,小米取消了传统手机影像模块,并对主板进行彻底重制;同时加入主动风冷,以支持最高 10W 的持续散热能力。 3
4
因此,O100 原型机更像一台“手机形态的 AI 演示终端”,而不是追求相机、静音、轻薄和续航平衡的常规旗舰。小米称,该机内置 MiMo 端侧模型,实测推理速度达到每秒 295 tokens。 3
5
这里的关键不只是速度本身,还在于它暴露出的工程取舍:当手机需要长时间运行大模型时,摄像头模组、主板空间、功耗和散热都会成为必须重新权衡的部分。
两款原型设备代表了小米端侧 AI 的两条路线:O100 是移动端概念验证,AI Cube 则是固定场景下的个人 AI 计算终端。
| 特性 | 玄戒 O100 原型机 | Xiaomi AI Cube 原型机 |
|---|---|---|
| 形态 | 手机衍生的 AI 演示终端 | 迷你主机与个人 AI 工作站 |
| 芯片配置 | 玄戒 O3 + O100 | 玄戒 O3 + O100 + D100 |
| 散热或持续性能 | 主动散热,最高支持 10W | 宣称最高 150W 持续性能释放 |
| 内存 | cited reports 未说明 | 80GB 统一内存 |
| 展示能力 | MiMo 模型实测每秒 295 tokens | 可部署 120B 模型与 3B 端侧模型,并支持快慢系统切换 |
| 产品状态 | 原型机 | 原型机 |
AI Cube 拥有更大的机身,也就有更多空间用于供电、内存和散热。它采用航空铝一体成型机身,表面布置了 33,874 个 CNC 精密镂空散热孔,小米称其可支持最高 150W 的持续性能释放。机身内部整合了玄戒 O3、O100 和 D100 三颗芯片,并配备 80GB 统一内存。 4
6
10
小米表示,AI Cube 可以同时部署一个 1200 亿参数的大模型和一个 30 亿参数的端侧模型,并根据任务需要在更快和更慢的系统之间切换。演示场景包括前端开发和复杂编程等高负载工作。 3
7
简单来说,AI Cube 更接近一台紧凑型本地 AI 工作站;O100 原型机的价值,则在于测试这种推理加速能力能否最终适应手机更紧张的功耗和散热空间。
两款原型机也对应了小米在 8 月 24 日玄戒芯片技术沟通会上公布的三芯片布局:
这套分工显示,小米正在尝试把自研 AI 计算能力扩展到手机、个人电脑和汽车,而不只是依赖云端处理。这是根据硬件方向作出的判断,并不意味着两款原型机已经确定会成为零售产品。
从商业化进度看,玄戒 O3 已进入量产,并计划于 9 月首先搭载在小米 18 Fold 上。O100 和 D100 虽然已经完成研发,但小米社区公告称,两者计划在次年正式商业化。 18
29
玄戒 O100 原型机让小米对端侧 AI 的设想变得具体,同时也把代价摆到了台面上:为了追求持续推理速度,它取消了传统影像模组,重做了主板,还需要主动风冷。这与主流旗舰手机追求影像能力、静音和轻薄的设计目标并不相同。
AI Cube 展示的则是另一种解法:只要提供更大的机身、更高的功耗和更多内存,就能在本地运行更大的模型、处理更重的任务。两款设备放在一起看,体现的是小米正在用不同形态测试自研芯片与端侧 AI 的组合方式。
目前最明确的消费级产品信息,仍然是搭载玄戒 O3 的小米 18 Fold。至于 O100 原型机,更适合被理解为一份研发和工程声明:小米认为,高速本地大模型推理未来有机会进入手机,但要真正变成实用的消费产品,还必须解决散热、功耗、软件兼容性以及整机设计等问题。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
小米玄戒 O100 原型机运行自家的 MiMo 端侧模型时,实测推理速度达到每秒 295 tokens,但它是技术验证设备,并非量产手机。
小米玄戒 O100 原型机运行自家的 MiMo 端侧模型时,实测推理速度达到每秒 295 tokens,但它是技术验证设备,并非量产手机。 Xiaomi AI Cube 原型机将同一套端侧 AI 思路扩展到迷你主机,采用三颗玄戒芯片、80GB 统一内存和最高 150W 的持续性能释放,可运行 120B 与 3B 模型。
目前距离消费者最近的是搭载玄戒 O3 的小米 18 Fold;小米表示 O100 仍处于原型阶段,计划晚些时候商业化。