高通发布第六代骁龙8超级至尊版:专为智能体AI重构的2nm旗舰芯片

2026/09/24 07:08阅读量 2

高通在2026骁龙峰会上发布第六代骁龙8超级至尊版,这是首款面向“智能体AI”重新设计的移动SoC。该芯片采用2nm制程,配备最高5GHz主频的Oryon CPU、支持Matrix Cores的Adreno GPU及增强型Hexagon NPU,旨在解决端侧智能体面临的内存墙和能效挑战。通过异构计算协同与存算优化,该平台支持在本地运行300亿参数MoE模型,实现从单次问答向全天候智能体工作流的转变。

事件概述

在2026骁龙峰会上,高通公司总裁兼CEO安蒙指出,行业正从以手机为中心转向以智能体(Agent)为中心的新体验模式。为应对这一变革,高通首次同时推出两款基于2nm制程的移动旗舰平台:第六代骁龙8超级至尊版第六代骁龙8至尊版。其中,第六代骁龙8超级至尊版位于产品组合顶端,拥有高通最顶级的配置,其核心设计理念是从智能体AI的需求出发,重新定义SoC的计算引擎。

核心技术与架构革新

针对智能体全天运行对算力、内存和续航的高要求,高通在CPU、GPU和NPU三个关键模块上进行了针对性升级,以突破“内存墙”瓶颈:

  • Oryon CPU:动态缓存管理

    • 引入业界首个最高主频达5GHz的移动CPU。
    • 新增 Oryon FlexCache 技术,使8个核心共享同一个L2缓存池,并根据负载动态分配资源。这减少了任务切换时数据从系统内存重新加载的时间,确保高频率真正用于计算而非等待。
  • Adreno GPU:矩阵核心与显存优化

    • 首次在GPU中加入 Matrix Cores(矩阵核心),允许AI任务(如超级分辨率、帧生成)直接在图形管线中处理,无需往返于NPU,从而加速通用AI负载。
    • 配备第二代18MB独立高速显存(HPM),保存渲染瓦片和中间结果,减少对外部系统内存的访问,功耗降低12%。
    • 性能最高提升44%,能效最高提升40%。
  • Hexagon NPU:强化Transformer支持

    • 共享内存增加50%,使更多模型状态、上下文和KV-cache保留在片上,降低外部DDR访问频率。
    • 加强了对Transformer架构的支持,Hexagon Element Accelerator专门处理关键运算,支持最高32K Token上下文。
    • 在部分模型上的预填充性能提升最高80%。
  • 存储与连接

    • 采用LPDDR6内存和UFS 5.0闪存,支持将模型权重保存在闪存中按需加载,进一步缓解内存压力。

智能体工作流与生态合作

第六代骁龙8超级至尊版不仅关注峰值性能,更强调系统级的异构协同,以支持智能体的“感知—理解—规划—执行”循环:

  1. 分工明确:CPU负责智能体编排、任务调度和路由;NPU承担主要推理和内容生成;GPU中的Matrix Cores处理图形相关的AI负载;传感器中枢以低功耗持续处理语音和环境情境。
  2. 实际部署案例:高通与阶跃星辰(StepFun)、无量火等合作伙伴合作,将 StepEdge-Omni 30B-MoE 模型完整部署到手机端。
    • 通过异构调度和存算协同,模型运行内存需求降低超过50%。
    • 预填充速度超过330 Token/s,解码速度超过28 Token/s。
    • 支持邮件理解、行程规划、日历同步等连续复杂任务。
  3. 多模态能力:第二代AI-ISP架构视频吞吐能力提升2倍,支持8K 60fps视频拍摄,将图像和视频转化为多模态模型可理解的上下文。

战略意义

高通此次发布的平台标志着旗舰SoC竞争标准的改变:从单纯追求CPU/GPU峰值性能,转向在有限内存和功耗限制下,让智能体保持持续感知、推理并与其他终端(PC、汽车、可穿戴设备)及云端保持连续协同的能力。第六代骁龙8超级至尊版被视为高通对下一代旗舰标准的回答,旨在构建覆盖多终端的智能体AI计算底座。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。