前途科技前途科技
  • 服务
  • 关于
  • AI
    • AI 大模型
    • 具身智能
    • 算力芯片
  • 科技
    • 智能终端
    • 软件·互联网
    • 汽车·出行
    • 科学前沿
  • 资源中心
    • 深度研究
      • AI 前沿
      • 教程
      • AI 知识库
      • 案例研究
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们
技术/09.24 · 07:08/5 MIN/编译自 雷锋网/0 阅读

专为AI智能体而生:高通发布第六代骁龙8超级至尊版

高通推出2nm旗舰芯片第六代骁龙8超级至尊版。该平台针对端侧AI智能体彻底重构CPU、GPU和NPU架构,突破5GHz主频,支持端侧运行300亿参数MoE大模型,标志着移动计算全面迈入智能体时代。

“我们正在从以手机为中心的模式,转向以智能体为中心的新体验。手机、PC、眼镜、可穿戴设备以及汽车,都将成为智能体的终端入口。”在 2026 骁龙峰会上,高通公司总裁兼 CEO 安蒙指出。

高通发布第六代骁龙8超级至尊版

过去二十年,智能手机始终围绕 App 运转。而 AI 智能体则需要全天候感知环境、理解上下文,并在无需用户实时操作的情况下自主执行复杂任务。这种全新的工作流要求计算架构彻底重构:CPU 负责智能体编排调度,NPU 高效处理 AI 推理,GPU 承载并行渲染与计算,协同通信能力也提升到了前所未有的高度。

为此,高通首次同时推出两款 2nm 制程移动旗舰平台——第六代骁龙8超级至尊版和第六代骁龙8至尊版。

2nm 制程双旗舰

其中,位于产品序列顶端的超级至尊版集成了多项突破性规格:最高主频达到 5GHz 的 Oryon CPU、首次引入 Matrix Cores(矩阵核心)的 Adreno GPU,以及支持在端侧运行 300 亿参数 MoE(混合专家)模型的 Hexagon NPU。

第六代骁龙8超级至尊版核心规格

破解“内存墙”:CPU、GPU、NPU 系统级动刀

第六代骁龙8超级至尊版最惹眼的参数是 5GHz 的 CPU 主频。

5GHz 移动 CPU

但端侧 AI 智能体真正的痛点在于“内存墙”与续航限制,而非单纯的峰值算力。模型推理需要高频读取权重、上下文、KV-cache 及中间计算结果。数据若在片上存储与系统内存间频繁搬运,会造成极大的延迟与功耗浪费。

为了打破内存墙,高通对整套 SoC 展开了系统级重构:

  • Oryon CPU 引入 FlexCache:8 个核心共享同一个 L2 缓存池,并根据负载动态分配。AI 智能体在串联执行多项任务时,数据无需在每次任务交接时重新自系统内存读取,有效消除了调度等待时间。

Oryon FlexCache 缓存架构

  • Adreno GPU 配备独立高速显存:搭载第二代 18MB 独立高速显存(HPM),用于暂存渲染瓦片、帧缓冲和中间结果,大幅降低图形管线对外部内存的依赖,实现 12% 的功耗缩减。

Adreno GPU 架构升级

  • Hexagon NPU 共享内存扩容 50%:让模型状态和 KV-cache 更多保留在片上,减少外部 DDR 访问频率。

Hexagon NPU 架构与共享内存

结合对 LPDDR6 内存与 UFS 5.0 闪存的支持,大模型权重能够常驻高速闪存,并按需快速调入内存,从片上到系统各层级缓解数据搬运压力。

专为 AI 智能体设计的异构协同系统

AI 智能体需要全天候执行“感知—理解—规划—执行”的闭环,单靠某个特定计算单元无法承载这一复杂的异构负载。

为智能体协同打造的计算平台

在第六代骁龙8超级至尊版上,各模块达成了明确分工:

  • Oryon CPU 掌控控制流、任务分发与云端 API 路由;
  • Hexagon NPU 运行端侧核心大模型。其新增的 Hexagon Element Accelerator 针对 Transformer 关键算子进行了专门加速,最高支持 32K Token 上下文窗口,部分模型预填充速度提升达 80%;
  • Adreno GPU 性能提升最高达 44%,能效提升 40%,且首次内置 Matrix Cores,允许超分辨率和插帧等 AI 任务直接在图形管线内部处理,省去与 NPU 之间的数据往返;
  • 高通传感器中枢 搭载双 Micro NPU,性能提升 85% 的同时功耗降低 20%,无需唤醒主芯片即可常态化感知语音、用户活动和环境情境。

Adreno GPU 首次加入 Matrix Cores

300 亿参数 MoE 落地端侧:从单次问答到连续工作流

这一架构最直观的落地成果,是手机端侧成功跑通 300 亿参数的 MoE(混合专家)模型。

该模型在推理生成每个 Token 时仅激活约 30 亿参数,在模型知识容量与移动设备的功耗、内存上限之间找到了极佳的平衡点。

端侧运行 300 亿参数 MoE 模型

高通联合阶跃星辰、无量火、江波龙,成功将 StepEdge-Omni 30B-MoE 部署在手机端。得益于异构调度与存算协同,该方案使模型运行内存占用降低逾 50%,预填充速度突破 330 Token/s,解码速度超过 28 Token/s。NPU 与 GPU 双引擎协同使预填充吞吐量提升了 30% 以上,能够顺畅处理邮件理解、行程规划、日历同步及酒店航班推荐等一连串复合任务。

端侧 AI 走向工作流

配合升级的第二代 AI-ISP 架构,手机不仅实现了 8K 60fps 视频拍摄,还能将高帧率视觉数据实时转化为多模态大模型可理解的连续上下文。

第二代 AI-ISP 架构

重塑下一代旗舰 SoC 的评价体系

AI 智能体的边界绝不仅限于一部智能手机,它还将延展至 PC、XR 眼镜与智能座舱。但手机因其随身性、情境感知能力和连接枢纽地位,依然是离用户最近的个人 AI 入口。

在这一演进路径下,旗舰芯片的评判维度已发生根本性转变:行业不再单纯追逐 CPU 或 GPU 的短时峰值跑分,而是聚焦在严苛的发热与续航边界内,能否支持 AI 智能体实现全天候感知、持续推理与多设备端云协同。

5GHz 频率与 30B MoE 模型的端侧落地只是外在显现,底层对内存墙的系统级攻克与异构协同调度,才是第六代骁龙8超级至尊版交出的答卷。

标签:端侧大模型AI 智能体芯片架构MoE

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

把 MuJoCo 搬上 GPU:MJWarp 迁移的四道闸门与三种不报错的错误
置顶

把 MuJoCo 搬上 GPU:MJWarp 迁移的四道闸门与三种不报错的错误

解码快 3 倍,端到端只快 1.5 倍:VLM 推测解码 DSpark 的账怎么算
置顶

解码快 3 倍,端到端只快 1.5 倍:VLM 推测解码 DSpark 的账怎么算

前途科技前途科技
服务关于快讯技术商业报告
微信咨询二维码

咨询微信

扫码添加微信咨询

前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款
Transformers 直接跑 GGUF:Python 追平 llama.cpp
置顶

Transformers 直接跑 GGUF:Python 追平 llama.cpp

//

24小时热榜

Anthropic旗下Claude自主发现类CRISPR新酶系统
TOP1

Anthropic旗下Claude自主发现类CRISPR新酶系统

TikTok与阿拉巴马州就青少年成瘾指控达成至少1亿美元和解
TOP2

TikTok与阿拉巴马州就青少年成瘾指控达成至少1亿美元和解

3

OpenAI Academy 升级,新增开发者与企业管理学习路径

8小时前
OpenAI Academy 升级,新增开发者与企业管理学习路径
4

OpenAI 升级 GPT-6 提示词缓存:Token 成本最高省 90%

8小时前
OpenAI 升级 GPT-6 提示词缓存:Token 成本最高省 90%
5

Airbnb深化与OpenAI合作,全面接入GPT-6 Astra加速开发

8小时前
Airbnb深化与OpenAI合作,全面接入GPT-6 Astra加速开发
6

ChatGPT广告业务拓展至东南亚及台湾地区

8小时前
ChatGPT广告业务拓展至东南亚及台湾地区
7

奥特曼联合国演讲:警惕AI失控,呼吁建立全球监管标准

8小时前
奥特曼联合国演讲:警惕AI失控,呼吁建立全球监管标准
8

OpenAI Academy 成立两周年:覆盖400万人,推社区培训师计划

8小时前
OpenAI Academy 成立两周年:覆盖400万人,推社区培训师计划
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断