高通骁龙新芯片为AI Agent重新设计
北京时间9月23日,在2026骁龙峰会上,高通CEO安蒙正式介绍面向Agent时代的战略转型,并发布两款新一代旗舰手机SoC:第六代骁龙8超级至尊版与第六代骁龙8至尊版。两款芯片均采用台积电2nm制程,搭载自研Oryon CPU,8核配置,包括两颗最高5GHz的Prime核心和6颗最高4GHz的Performance核心,为业界首次将手机CPU主频提升至5GHz。高通首次在同一代骁龙8 Elite系列中推出两个不同定位的旗舰产品。

新芯片以AI算力为核心升级方向,重点提升端侧AI智能体推理、内存架构、个性化和多模态处理能力。CPU引入Oryon FlexCache技术,配备16MB共享L2缓存,允许核心动态访问缓存资源池。封装采用Offset PoP,使高负载下维持峰值性能的时间延长至原来两倍以上。GPU方面,全新Adreno GPU加入Adreno Matrix Cores,推出Adreno Neural Fusion,将神经网络计算、AI超级分辨率和帧生成整合到同一渲染管线,支持游戏中最高40%功耗节省,已获Unity和虚幻引擎支持。AI算力上,Hexagon NPU针对Transformer、大规模MoE模型及AI Agent优化,新增Element Accelerator,INT4模型Prefill性能最高提升50%,NPU共享内存增加50%,超级至尊版最多支持端侧运行30B参数MoE模型,已联合阶跃星辰等落地StepEdge-Omni 30B-MoE。Sensing Hub采用双Micro NPU架构,性能提升最高85%,支持Personal Scribe。影像方面升级Spectra ISP,引入智能像素控制与Elite Color Engine,超级至尊版支持VVC硬件解码,最高节省55%功耗。通信方面配备X105 5G调制解调器及FastConnect 8800,后者引入4×4 Wi-Fi系统,支持Wi-Fi 8。两款芯片CPU、制程和基带相同,差异主要在GPU、缓存、内存和NPU共享内存。


安蒙发表题为“面向智能体时代的骁龙”演讲,提出个人计算正从“手机为中心”转向“以AI Agent为中心”。他认为,随着MoE模型、Agent等技术发展,端侧设备未来形态已清晰。Agent能理解需求并代替用户完成任务,未来AI手机核心标准可能是“能帮你干多少活”,需具备长期上下文、任务规划、跨应用调用及授权下执行操作的能力。手机角色将变化,不再一定是直接操作对象,也可作为信息和计算节点,由Agent驱动其他设备。Agent时代智能手机需支持两个维度:人直接使用,以及Agent帮人使用,后者需持续感知环境、理解意图、推理规划记忆和操作。移动端Agent需具备访问授权个人知识、维护上下文和记忆、安全权限机制、多模态理解、协调不同模型与应用服务、跨设备连续体验等能力。未来即使用户不主动操作,Agent也可能在后台持续使用计算资源,因此内存和能耗效率重要性凸显。安蒙提出Agent普及标准:必须比用户自己操作更简单。
更多推荐阅读

AI替你干活后,谁还为你成长买单?
一个人还在学习的现场,工作却已经可以绕过他完成。 在机器人手术室里,主刀医生坐在控制台前操纵机械臂,年轻住院医师却可能只负责清除烟雾和积液,或坐在另一台控制台前观看。研究技术与工作的学者马特·贝恩用两年多时间观察发现:传统手术往往需要两个人、四只手,年轻医生参与其中也就有了练习机会;机器人让专家可以独自操作,学徒成了可选项。 这里的“可选”比“被替代”更值得深思。年轻医生没有被赶出手术室,仍能...
2026-09-25
实时世界模型PixVerse R2走红 用户可实时操控剧情走向
从“看视频”到“操控世界”,一款实时世界模型近日在海外走红。9月22日上线当天,爱诗科技(AIsphere)最新发布的实时世界模型PixVerse R2登上X(Twitter)趋势榜第二。有海外网友认为,这标志着AI生成从“创作视频”转向“与AI世界互动”,不像是看视频,更像是身临其境。 在PixVerse R2创造的世界中,用户可以移动、说话、做出选择。每一个提示词、每一个动作,都会实时改变眼...
2026-09-25
DeepSeek梁文锋署名论文:沙盒如何开启RSI闭环
DeepSeek联合清华大学发表论文《DeepSeek Elastic Compute(DSec): A Sandbox Infrastructure for Effective Agentic Training at Scale》,9月19日提交arXiv,编号2609.22978,作者超130人,梁文锋署名最后一位。 论文核心是公开DeepSeek训练Agent所用的沙盒平台DSec。训练A...
2026-09-25
昇腾超节点破三堵墙,十万亿大模型训推最优解
2026年AI圈的关键词是“智能体”。AI从能聊到能干,推理需求指数级爆发,预计2030年全球每月Token消耗超120千万亿,暴涨24倍。顶级MoE模型参数量达十万亿级,训练压力同步增长。传统服务器难以应对,超节点成为行业公认的更优路径,可解决“存储墙”和“通信墙”,但真正商业化落地者很少。 昇腾950超节点在华为全联接大会2026期间正式上市,成为业界最大规模商用超节点,包括Atlas 95...
2026-09-25
代码生成提速后,软件交付瓶颈转向何处?
2026年9月22日,阿里巴巴集团CEO吴泳铭在杭州云栖大会演讲中提出,机器正成为思考的主力,智能正成为规模化商品,未来机器思考总量将达人类1000倍以上。与技术底座演进同步,阿里研发方式加速向AI Native转变,Agent不再只用于生成代码,而是进入需求、开发、测试、发布和运维各环节。 9月23日,“智启原生 研见未来”阿里巴巴集团AI Native研发实践论坛在云栖大会举办。机器之心主编...
2026-09-25
端侧AI成新战场,斑马智能要让汽车变身token工厂
2026云栖大会上,Agent Native成为AI新主流叙事,产业焦点从云侧AI基础设施转向端侧。千问发布Qwen Intelligence进入AI手机,AI眼镜、耳夹式耳机、录音硬件、原生桌面终端同期亮相。斑马智能首席产品官蔡明表示,车对AI尤其是Agent的诉求更迫切,将成为AI体验最好的具身智能终端。 杭州国际博览中心举办“原生智能·端上生长——Agentic AI重构下一代终端”论坛,...
2026-09-25