资讯

高通第六代骁龙8至尊版系列集成全新Hexagon NPU:专为AI智能体打造

驱动之家·2026/9/10 16:01:00🔗 原文

📋总体概括

高通官网介绍第六代骁龙8至尊版系列的全新Hexagon NPU,专为AI智能体设计,引入两大关键特性:Element Accelerator加速器与更大的共享内存系统。前者针对Transformer工作负载优化生成式与智能体AI推理,后者让多模型状态、上下文与KV-cache数据更靠近计算单元,缓解内存瓶颈。此外,高通正与内存及模型厂商合作引入MoE架构,300亿参数模型每次生成词元仅需激活约30亿参数,推动智能体AI在终端侧落地。

关键信息

  • 高通第六代骁龙8至尊版系列集成全新Hexagon NPU,主打终端侧AI智能体体验
  • 新增Element Accelerator,专为加速生成式AI和智能体AI的Transformer工作负载而设计
  • 大幅扩展共享内存,将KV-cache等数据存放在靠近加速器处,缓解内存瓶颈、支持更长上下文与并发任务
  • 与内存和模型厂商合作引入MoE架构,300亿参数模型每词元仅需激活约30亿参数,降低计算与带宽需求
  • Element Accelerator与向量、标量单元及共享内存组成协同架构,兼顾性能与移动端能效

🔥犀利点评

高通这步棋指向很明确:AI的下一战场在终端而非云端。拿MoE架构做文章是聪明的——用30亿激活参数跑300亿总参数,等于把「大模型上手机」从营销话术变成工程现实。但真正的胜负手不在NPU算力,在内存带宽和功耗,手机那点空间塞得下多少上下文仍是硬约束。终端智能体叙事讲得再好,还得看生态端何时真能跑出不可替代的应用。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文