骁龙新一代旗舰移动平台发布在即,高通在官方博客中正式揭晓了其搭载的全新Hexagon NPU。这一次升级的核心,不仅仅是算力提升多少的简单叙事,而是一个更根本的转变:NPU的角色正在从执行单一模型的推理单元,变成调度多个专用模型的协调中枢。
高通技术公司产品市场高级总监Cisco Cheng在署名博客中给出了一个明确的判断:随着AI智能体化的深入,脱颖而出的架构不是依赖单一庞大模型处理所有任务,而是由多个专用模型组成的系统,根据任务、情境和用户需求进行智能调度。这句话,是理解新一代Hexagon NPU全部设计逻辑的钥匙。

高通做NPU,比大多数人想象的要早得多
很多人不知道,Neural Processing Unit(NPU)这个概念,最早就是高通提出的。2013年,高通发布了一个名为Zeroth的独立NPU项目,目标直指“定义一种全新的处理架构”——神经处理单元。到了2015年的骁龙820,高通已经将研究成果落地为实际能力:Hexagon 680 DSP实现了基于加速器的计算机视觉感知、低功耗语音唤醒和本地恶意软件行为分析。全时开启的传感器数据处理、随时在线的语音唤醒——这些功能在当时看足够超前,放到现在也不落伍。
2018年的骁龙855是另一个节点。高通在Hexagon 690中首次加入独立的张量加速器,让NPU正式具备针对深度学习模型的专用加速能力。从这一代开始,Hexagon NPU的架构轮廓逐渐清晰。
正因在这条路上走了很久,高通对于NPU应该怎么设计、如何使用,向来有自己的想法。

NPU升级的两个重点:计算更强,调度更顺
回到即将发布的骁龙新一代旗舰平台。高通公布的信息显示,NPU的改进集中在两个层面。
Element Accelerator:让NPU学会“调度”。 这是新一代Hexagon NPU最核心的变化。传统NPU的设计重心在“算”:把矩阵乘法做快。但智能体需要的不只是“算”,还需要“想”:在推理过程中选择走哪条路、调用哪个工具、下一步做什么决策。Element Accelerator让NPU第一次同时具备高效计算和智能调度两类能力,配合Fast Action Loops和KV-Cache加速,支持最长32K的上下文长度。

免责声明:本文为转载,非本网原创内容,不代表本网观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
如有疑问请发送邮件至:bangqikeconnect@gmail.com