小米玄戒O3于8月24日正式发布,其NPU张量算力达到200TOPS,端侧AI性能相比前代提升45%,凭借这一成绩,玄戒O3的AI算力已经稳居移动芯片行业第一梯队。
一、NPU算力参数:行业领先的硬指标
张量算力:玄戒O3的NPU拥有200TOPS张量算力(INT8精度),这一数字处于当前旗舰SoC的顶尖水平,足以支撑端侧大模型的流畅运行。
向量算力:向量算力达3.13TFLOPS,采用SIMT单指令多线程架构,配合霍夫曼无损压缩技术,让端侧AI推理效率大幅提升。
专项优化:NPU并非简单堆料,而是专为Xiaomi MiMo端侧大模型定制,支持5值量化模型,MiMo 3B模型的Decode性能达传统旗舰处理器的1.45倍。

二、端侧AI性能提升:从跑分到体验的落地
综合提升:端侧AI性能相比前代玄戒O1提升45%,这意味着在AI写真生成、实时语音助手、端侧摘要等场景中,玄戒O3能提供更快的响应速度和更低的功耗。
全模块AI化:除独立NPU外,玄戒O3将AI能力渗透至全模块——CPU新增双SME2加速单元、GPU集成8颗NX神经网络加速器、ISP内置AINR单元、DPU内置硬件AI超分单元。
存内计算优势:行业首发支持LPDDR6内存,带宽高达113.8GB/s,相比LPDDR5X提升48%,为端侧大模型提供了充足的数据吞吐通道,有效缓解“内存墙”瓶颈。
三、行业坐标:独立NPU+全模块协同的双重打法
NPU独立性:与部分竞品将AI功能分散集成不同,玄戒O3保留了独立NPU(4核低功耗架构),这一设计确保了大模型任务能由专用单元承接,避免抢占CPU/GPU资源,能效更优。
同级对比:小白测评的能效天梯榜显示,玄戒O3在CPU和GPU能效上均位列第一,体现了AI算力释放与功耗控制的平衡能力。
生态纵深:玄戒O3是小米“人车家全生态”AI算力底座的核心,与同期发布的AI加速芯片O100、智驾芯片D100协同,构成全场景AI算力矩阵。
