Architecture note
如何理解这颗芯片
玄戒 O100 是小米面向端侧大模型的独立 AI 加速器,公开重点不是峰值 TOPS,而是 6 nm 晶圆级垂直堆叠与 1.22 TB/s 内存带宽。
现阶段展示以技术验证机和 AI Cube 为主,计算精度、峰值算力、内存协议和量产封装仍未给出完整官方规格,因此置信度标记为“中”。
主要存储瓶颈
3.5 GB 容量仍限制可驻留模型规模;系统性能还取决于主 SoC 与 O100 之间的数据路径。
XRING · AI Accelerator · 2026
把 AI 专用内存垂直堆叠在计算层附近,以 1.22 TB/s 带宽突破端侧 DRAM 墙。
Memory thesis
O100 是值得重点追踪的 memory-first 端侧架构,但现阶段应把发布会数字与最终量产 SKU 严格区分。
Memory hierarchy
沿着数据离计算核心越来越远的方向阅读。真实带宽不只取决于介质,也取决于布局、复用和互联。
14 核 NPU 的局部存储细节尚未公开。
公开容量 3.5 GB、带宽 1.22 TB/s,以超密键合连接计算层。
加速器与主 SoC 协同,完整一致性和编程模型待披露。
Architecture note
玄戒 O100 是小米面向端侧大模型的独立 AI 加速器,公开重点不是峰值 TOPS,而是 6 nm 晶圆级垂直堆叠与 1.22 TB/s 内存带宽。
现阶段展示以技术验证机和 AI Cube 为主,计算精度、峰值算力、内存协议和量产封装仍未给出完整官方规格,因此置信度标记为“中”。
主要存储瓶颈
3.5 GB 容量仍限制可驻留模型规模;系统性能还取决于主 SoC 与 O100 之间的数据路径。
Evidence