在8月24日的小米玄戒芯片技术沟通会上,一款名叫“玄戒O100原型机”的端侧高速AI演示终端成为全场焦点,它取消了影像模块并加装主动风冷,在完全断网状态下实现了近乎零延迟的本地大模型推理,让现场媒体直呼“快的离谱”。

  

  

  一、原型机形态:魔改自阔折叠的“AI性能怪兽”

  基于小米18 Fold魔改:原型机外形与小米18 Fold阔折叠基本一致,但屏幕被框架固定不能折叠,摄像头被替换为散热结构。

  双芯协同架构:采用玄戒O3负责系统运行、玄戒O100专职AI加速的双芯片组合,将传统手机影像主板推倒重来。

  主动风冷加持:背部加入类似红米主动散热的风扇,提供最高10W的解热能力,确保性能满血释放。

  二、端侧AI性能:断网也能“秒回”的恐怖速度

  纯本地运行:现场演示设备不插卡、不联网,全程在端侧完成大模型推理。

  近乎零延迟:首Token延迟约0.5秒,按下发送即出结果,实测推理速度达每秒295-300 Tokens。

  带宽是关键:玄戒O100提供1.22TB/s超高带宽,是传统旗舰手机的16倍,为高速推理奠定基础。

  三、定位与展望:端侧AI基础设施的“先行者”

  非量产技术验证机:现场工作人员明确表示该机不会量产,主要展示玄戒O100在端侧AI场景的能力上限。

  O100明年商用:玄戒O100已研发完成,计划2027年正式商用,未来将覆盖手机、机器人、NAS等更多设备。

  打造AI算力底座:与玄戒O3、D100共同构成小米“人车家全生态”AI算力底座,为端侧大模型普及铺路。