精华简报:小米「米芯」三连发——从旗舰 SoC 到端侧 AI 算力底座
TL;DR
小米在 8 月 24 日发布三颗自研芯片:旗舰手机 SoC 玄戒 O3、AI 加速芯片 玄戒 O100、智驾/桌面芯片 玄戒 D100。其中 O3 以 522 万安兔兔跑分登顶安卓性能榜首,但真正的战略信号来自 O100——它通过 6nm 晶圆级 3D 堆叠将内存带宽推至 1.22TB/s,是主流旗舰 LPDDR5X 的 16 倍,直击端侧大模型推理的“内存墙”瓶颈。三颗芯片共同构成小米“从口袋到座舱、从客厅到工厂”的端侧算力底座,标志着小米造芯从“追赶旗舰 SoC”升级为“为端侧 AI 时代提前囤积弹药”。五年 210 亿投入、近 3000 人团队,小米给出的造芯理由已不只是“不受制于人”,而是“小米 AI 战略的物理基础”。
核心观点与技术/商业洞察
1. 玄戒 O3:追平旗舰,但跑分只是“烟花”
- 性能数据:3nm 工艺,240 亿晶体管,CPU 十核全大核,最高主频 4.35GHz;Geekbench 6.5 单核 3945、多核突破 15000,较上代分别提升 31% 和 60%;GPU 光追性能暴涨 182%,功耗降低 64%;首款支持 LPDDR6 的移动 SoC,带宽 113.8GB/s,访存时延 82ns。
- 战略定位:O3 证明小米“造得不比别人差”,完成从“能造旗舰芯片”到“旗舰芯片不落后”的跨越。但文章明确指出,跑分是烟花,真正的信号在 O100。
2. 玄戒 O100:用 3D 堆叠推倒“内存墙”
- 端侧大模型的核心瓶颈:生成式 AI 每吐一个 token,都需要把数十亿甚至上百亿参数从内存完整搬运一遍。决定速度的往往不是 NPU 算力,而是内存带宽。过去几年 NPU 算力翻倍增长,但内存带宽受引脚数量限制,计算单元大量时间在等数据——这就是业界所称的“内存墙”。
- 小米的解法:采用晶圆对晶圆(WoW)键合,将两层 AI 专用内存晶圆与一层 NPU 计算晶圆垂直堆叠,键合间距 1.4μm,数据通路从“平面走线”改为“垂直穿透”。这是全球首颗 6nm 晶圆级堆叠 AI 加速芯片。
- 关键数据:带宽达到 1.22TB/s,是主流旗舰 LPDDR5X(76.8GB/s)的 16 倍。配合玄戒 O3 与 MiMo 端侧模型,双芯原型机本地推理最高跑到 330 token/s,远超人类舒适阅读速度(每秒十来个词),端侧推理首次谈得上“富余”。
- 配套优化:芯片团队与模型团队联合定制 5 值量化 MiMo 模型,配合 NPU 硬件无损压缩,推理效果与传统 INT4 量化相当,内存带宽再省 30%。
- 冷静观察:O100 采用 6nm 而非最尖端制程,赢在封装与架构而非制程军备;且要到明年才正式商用,良率、成本、落地产品价位均未披露。
3. 玄戒 D100:从座舱到桌面的“大端”算力
- 定位:国内第一颗 3nm 智驾芯片,20 核 CPU,最高支持 160GB 统一内存,本地最大可部署 200B 参数模型。
- AI Cube 原型机:小米将 D100 提前装进航天铝一体成型桌面主机,本地同时部署 120B(深度思考)和 3B(即时响应)两个模型,按需切换。但 AI Cube 目前只是原型机,无价格、无档期,需等明年 D100 商用。
4. 小米造芯的“第三种理由”
- 历史脉络:2017 年澎湃 S1 市场反响平平,大芯片项目停摆;2021 年重启造芯时,行业语境是华为被断供后的“不受制于人”;2023 年 OPPO 解散哲库,中国旗舰自研 SoC 牌桌上只剩华为与小米。
- 战略升级:小米此次给出的理由已超越“不受制于人”。五年 210 亿、近 3000 人,攒出的不只是一颗手机 SoC,而是基带 T1、AI 加速 O100、智驾 D100 加 MiMo 大模型的“会师”。雷军将其定义为“小米 AI 战略的物理基础”。
- 与苹果、华为的差异:苹果造芯为体验闭环,华为造芯为求生,小米则押注尚未完全到来的端侧 AI 时代,提前囤积下一场战争的弹药。这是一场赌注——云端模型能力每几个月抬一次天花板,端侧 AI 的价值最终要靠产品回答。
对行业的启发与影响
1. 芯片竞争维度从“制程军备”转向“封装与架构创新”
玄戒 O100 用 6nm 工艺实现 1.22TB/s 带宽,证明在端侧 AI 场景下,内存墙的突破比单纯堆算力或追最尖端制程更具性价比。晶圆级 3D 堆叠、垂直数据通路可能成为下一代 AI 芯片的关键竞争点,为国内芯片企业在先进制程受限背景下提供了一条差异化路径。
2. 端侧 AI 从“能跑”走向“富余”,交互范式或生变
330 token/s 的本地推理速度意味着端侧大模型首次具备“富余”算力,用户与大模型打交道的方式可能不再必须经过云端。这将直接冲击隐私保护、响应延迟、离线可用性等体验维度,也可能改变云端推理的成本结构。
3. 全场景终端布局成为小米的独特护城河
小米同时握有手机、汽车、家电一整套“端”,芯片可以沿自家产品线铺开,形成“口袋—客厅—座舱”的算力闭环。相比英伟达的桌面 AI 电脑、苹果的 M 系芯片,小米的差异化在于终端场景的完整性和芯片与自研模型、系统的深度耦合。
4. 中国自研芯片格局进一步收敛,小米路径提供新样本
在 OPPO 退出后,中国旗舰自研 SoC 仅剩华为与小米。小米以“AI 算力底座”而非单纯“替代进口”为叙事,可能影响其他厂商对自研芯片战略的重新评估——造芯的终点不一定是手机 SoC,而是面向 AI 时代的端侧算力基础设施。
5. 风险与不确定性依然高悬
O100、D100 均未商用,良率、成本、落地产品价位未知;AI Cube 原型机无价格档期;端侧 AI 的真实用户价值(隐私、成本、响应速度)尚未被市场验证。小米的赌注能否兑现,明年商用才是真正的摊牌时刻。522 万分证明小米追上了这个时代的旗舰芯片,但玄戒真正想赢的那场牌局,才刚刚开局。
来源:极客公园《「米芯」三连发:雷军五年花了 210 亿,归来已「不只手机」》