高通新一代骁龙旗舰芯曝光:CPU/GPU/NPU全面进化,AI智能体时代来了
各类智能终端正加速向智能体方向进化,AI从云端走向边缘。用户一句话即可让智能体完成数十甚至上百步复杂操作,有时无需说话,智能体便能感知环境、理解需求并主动提供服务。这一切离不开底层芯片支撑,智能体趋势正加速芯片在性能、功耗、端侧算力、存储和安全等方面的进化。

高通提前剧透了将于2026骁龙峰会发布的新一代骁龙旗舰移动平台的技术升级,涵盖CPU、GPU、NPU等核心模块面向AI智能体的能力强化。从CPU缓存架构革新、AI渲染集成图形管线、GPU专用AI核心引入,到NPU计算单元和共享内存升级,新一代平台完成围绕智能体的全面进化,将成为2026年下半年旗舰AI手机的关键底层支撑。

NPU成智能体时代“刚需”。高通将发布新的Hexagon NPU及两项关键技术创新:Element Accelerator和更大的共享内存系统。Element Accelerator专为生成式AI和智能体AI的Transformer工作负载打造,结合向量与标量计算单元,加速大模型关键运算。Hexagon NPU扩展大容量共享内存,让模型状态、上下文信息和KV-cache数据更靠近AI计算单元,缓解内存瓶颈,使智能体处理长上下文、调用工具及并发任务时更流畅,实现更快token生成速度。

高通还与行业头部内存和模型厂商合作,引入混合专家模型构建新一代终端侧AI架构。一个300亿参数的MoE模型每次生成一个词元仅需激活约30亿个被路由选中的参数,结合专家模块闪存到内存加载管理与缓存技术,以低功耗和低内存需求实现更大模型级别AI体验。Hexagon NPU支持INT2、INT4、INT8、FP8和FP16,基于INT4的模型可实现最高50%的预填充性能提升、更快的解码吞吐速度,首次生成时间低于1.5秒。
Oryon CPU方面,新一代成为业内首个最高主频达5GHz的移动CPU,并非仅靠先进制程,而是完整定制化设计,从微架构到子系统精细调校。关键IPC性能也进一步提升,让手机在启动App、网页、游戏、内容创作等场景更流畅。高通还引入动态缓存架构Qualcomm Oryon FlexCache,支持异构计算核心访问相同缓存池,系统可根据工作负载动态调整缓存资源。高负载下超级内核可充分利用整个缓存池,峰值性能更持久。在存储供应短缺背景下,FlexCache减少核心访问系统内存频率,即使内存受限也能提供稳定性能。智能体执行一连串任务时,所有核心共享同一缓存空间,任务切换时数据保留在缓存中,无需重复加载,协同更高效。
GPU层面,高通推出AI图形渲染技术Adreno Neural Fusion,将神经处理、AI超分和帧生成统一整合到单一图形管线,降低渲染成本和功耗的同时实现更高视觉质量。高通还首次将专用于AI的GPU核心Adreno Matrix Cores引入图形管线,搭配18MB的Adreno独立高速显存,实现AI工作负载本地处理,降低延迟、延长续航。英伟达、苹果此前已分别在GPU中加入专用AI核心,高通入场进一步证明这是行业头部玩家共识的GPU迭代方向。高通称,从NPU、CPU到GPU,骁龙平台每个核心引擎都已得到Matrix加速能力加持。
更多推荐阅读

Kimi全球招人:辍学、创业失败者优先
本周三,Kimi首次面向全球开启公开招聘。此前K3火爆出圈,Kimi此时开闸招人,不仅招算法,也大规模招募产品、运营、设计、销售、市场及国际化等业务岗位,业务团队首次面向2027届、2028届毕业生和在校实习生开放校招。同时,Kimi计划在全球招募7名“Wild Card”,定位为下一代接班人/未来业务合伙人。 更值得关注的是其用人信号。招募材料明确列出几类不会成为减分项的经历:休学或辍学、连续...
2026-09-13
Kimi K2.8上线:性能逼近K3,百万上下文全员开放
9月11日,Kimi K2.8 Preview在Kimi Code和Kimi Work全量上线,官方称综合性能接近旗舰K3,Coding和Agent能力进一步提升。最实质的变化是权限:所有会员档位都能用上1M上下文,而K3的百万上下文仍需Allegretto及以上会员。 就在前一天,外界获悉月之暗面ARR在8月突破10亿美元,6月这一数字还是3亿。这轮增长的直接催化剂是7月发布的K3,曾凭借SO...
2026-09-13
模型越强Harness越轻还是越重?OpenAI与Anthropic工程师给出相反答案
模型越来越强后,Harness 会变重还是变轻?OpenAI 和 Anthropic 工程师给出不同判断。OpenAI Codex 团队 Tibo 认为,随着模型进步,开发者消息会越来越短,Harness 会越来越轻。Anthropic Claude Code 团队 Thariq Shihipar 则认为,模型越强,Harness 反而越复杂,因为要让模型做更多事。 Tibo 表示,Codex ...
2026-09-13
OpenClaw之父复盘生死8个月:被断供、围剿与18000人提交
图片来源:Peter Steinberger 我常反省:是不是我设计的循环有问题?是不是没给Agents提供验证工作所需的一切?是不是思路有误?是不是在要求不可能的事? 我们不应再考虑“会话”或“上下文压缩”。我们正进入一个新世界,终于要从纯文本界面转向语音和多模态。昨天我们跑通一个hack,现在你的Claw可以给你打FaceTime。这才是OpenClaw存在的意义。 八个月里,超过18,...
2026-09-13
Meta新AI应用Muse美区下载量破8万,登App Store第二
Meta的新AI应用Muse于周二上线后,正开始赢得华尔街青睐。这家科技巨头进军Agentic AI领域,也成为业内人士在X平台上热议的话题。早期数据为了解Muse在美国消费者中的实际受欢迎程度提供了参考。 市场情报公司Sensor Tower数据显示,Muse在美国iOS平台下载量已超过83,000次。该应用目前仅限美国地区使用。尽管这一成绩使Muse登上App Store热门榜单第二位,但与...
2026-09-13
北大系公司押注端侧AI:27B模型装进电脑,断网也能干活
一个27B参数的模型原生存在于电脑里,关掉Wi-Fi照样能读取本地文件、翻数据库、处理Excel、写PPT,连续跑过去通常需要调用云端大模型的复杂任务。公司财务数据不用上传,自己的知识经验留在本地,跑得再多也不用盯着随Agent工作时间不断上涨的Token账单。电脑买了,电费交了,剩下的Token随便用。 过去端侧AI唯一麻烦的是模型不太行。1B、3B模型装进手机已不稀奇,但让它读几千条银行流水...
2026-09-13