产品派
返回

高通发布两款2nm骁龙旗舰平台押注智能体AI

硬件雷锋网2026/9/24 07:08:00
AI 导读

高通在2026骁龙峰会上表示,终端正从以应用为中心转向以智能体为中心,手机、PC、眼镜、可穿戴设备和汽车都将成为智能体入口。为此,公司首次同时推出两款2nm移动旗舰平台。

两款平台共享多项技术,其中第六代骁龙8超级至尊版定位最高端,搭载最高5GHz的移动CPU、首款加入Matrix Cores的Adreno GPU,以及可运行300亿参数MoE模型的NPU。

智能体需要持续感知、理解、规划和执行,瓶颈不只在峰值算力,也在内存、续航和数据搬运。高通因此从CPU、GPU、NPU和存储协同角度重新设计平台。

Oryon CPU采用FlexCache,8个核心共享L2缓存池并动态分配资源,减少任务切换时反复访问系统内存。Adreno GPU配备第二代18MB独立高速显存HPM,功耗最高降低12%;Hexagon NPU共享内存增加50%,LPDDR6与UFS 5.0则负责承载更大的模型和长期数据。

5GHz的意义不仅是单项任务更快,也能缩短智能体连续决策链中的调度等待。缓存、系统内存和闪存共同减少模型权重、上下文、KV-cache及中间结果的搬运开销。

平台的Adreno GPU性能最高提升44%,能效提升40%,并首次加入Matrix Cores,使超级分辨率、帧生成等AI任务可直接留在图形管线中处理。

Hexagon NPU强化Transformer支持,最高支持32K Token上下文,部分模型预填充性能提升80%。传感器中枢的双Micro NPU性能提升85%、功耗降低20%,可持续处理语音、活动和个人情境。

在异构架构中,CPU负责智能体编排、路由和调度,NPU承担主要推理,GPU处理并行计算和图形AI,传感器中枢负责低功耗感知。高通称,GPU性能与能效的提升是其最大幅度的代际升级。

第六代骁龙8超级至尊版已能在手机端运行StepEdge-Omni 30B-MoE。通过推理引擎及CPU、GPU、NPU协同,内存需求降低超50%,预填充速度超过330 Token/s,解码超过28 Token/s,NPU与GPU协同预填充吞吐较仅用NPU提升超30%,可执行邮件理解、行程规划和日历同步等连续任务。

平台还支持个人知识整理、多模态影像理解及8K 60fps视频拍摄,覆盖办公、游戏和影像场景。高通正将同样的异构计算与混合AI思路扩展到PC、耳戴设备、眼镜、手表和汽车,让手机连接云端并成为个人AI枢纽。未来旗舰竞争不只看CPU、GPU峰值,还要看设备能否在有限内存、功耗和散热条件下让智能体持续运行。

高通骁龙8端侧AI智能体移动芯片

本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。

阅读原文