肉呆大魔王
26-09-25 03:28 微博认证:微博VLOG博主 头条文章作者

一个智能体收到指令之后,要理解内容、制定计划、调用工具、执行任务、检查结果,再决定下一步。高通把这个过程叫做 Agentic Loop。这套循环不是全部扔给NPU处理,而是分给芯片里的不同单元。

Oryon CPU负责调度和决策。第六代骁龙8超级至尊版的Oryon最高达到5GHz,还配了 16MB Flex Cache。高通在PPT上直接把它对应到了Planning和Prediction,也就是智能体的规划和预测任务。CPU负责决定下一步做什么,Hexagon NPU和Adreno GPU负责模型推理,Sensing Hub负责常驻语音输入。

GPU这一侧也出现了专门的AI硬件。Adreno加入 Matrix Cores,让AI模型可以直接进入GPU图形管线,同时配了 18MB HPM高性能内存。高通给出的数据是,HPM带来12%的功耗改善,Adreno Neural Fusion相比上一套方案节省40%的功耗。

高通没有把“端侧智能体”理解成一颗更大的NPU,而是把任务拆开。CPU负责规划,NPU负责推理,GPU负责图形和AI计算,Sensing Hub负责持续感知。#骁龙峰会#

发布于 美国