当前位置:首页 / 业界 / 正文

高通新一代Hexagon NPU集成至第六代骁龙8至尊版系列 面向终端侧AI智能体

来源:互联网

高通新一代Hexagon NPU集成至第六代骁龙8至尊版系列 面向终端侧AI智能体 图1

高通在其官网介绍了新一代Hexagon NPU,这款NPU专为下一代AI智能体打造。第六代骁龙8至尊版系列引入了全新的Hexagon NPU和两项关键特性,包括全新Element Accelerator和更大的共享内存系统。

面向Transformer工作负载的加速设计

Element Accelerator专为赋能当今生成式AI和智能体AI的Transformer工作负载而打造。结合向量计算单元和标量计算单元,它能够加速大模型中最关键的运算,帮助智能体更快地响应、更高效地推理,并在保证移动端能效的前提下,提供更丰富的体验。

扩展共享内存以缓解瓶颈

Hexagon NPU大幅扩展了大容量共享内存。通过让多模型状态、上下文信息和KV-cache数据存储在更靠近加速器的位置,该平台能够缓解内存瓶颈,让智能体在处理更长上下文、调用更多工具以及执行更多并发任务时,始终保持流畅响应。

上述技术创新共同定义了新一代Hexagon NPU的角色,即直接在终端侧运行更多智能体AI体验。

协同架构与下一代模型支持

Element Accelerator、向量与标量扩展单元和更大的共享内存,组成一套协同架构,助力NPU加速Transformer工作负载、处理控制逻辑复杂的智能体任务,并将更多上下文数据保留在靠近计算单元的位置。Hexagon NPU同样面向下一代模型架构而打造。

高通表示,公司正与领先的内存和模型厂商合作,引入混合专家模型构建新一代终端侧AI架构。混合专家模型通过选择性激活专用专家网络,能够提升效率和质量,无需每次请求都调用整个模型。与每次推理都需要更大部分网络参与的密集模型不同,混合专家模型会根据输入动态选择专用专家网络,从而减少实际计算负载和内存带宽需求。

结合智能的专家模块闪存到内存加载管理机制与缓存技术,这种方法能够以低功耗和低内存需求的方式实现更大模型级别的AI体验,为智能手机带来响应迅速且注重隐私保护的生成式AI。

声明:

1、凡本网注明“来源:XXX(非科极网)”的作品,均转载自其它媒体,转载目的在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。

2、如因作品内容、版权和其他问题需要与本网联系的,请在该事由发生之日起30日内进行。