华为灵衢破解算力瓶颈:10万卡利用率飙升15%

华为灵衢破解算力瓶颈:10万卡利用率飙升15%

AI 资讯 来源:新闻/公众号 发布时间:2026-09-20 更新于 2026-09-20 预计阅读 4 分钟

9月17日至19日,华为2026年全联接大会上,华为围绕灵衢互联架构及超节点集群推出昇腾960芯片、昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品,“灵衢”成为贯穿发布的关键词。

灵衢是华为算力底座的统一互联总线协议,将CPU、NPU、DPU、DDR、SSD等计算与存储单元统一互联,并贯穿单机、超节点和超大规模集群。传统互联下,十万卡集群实际算力使用率仅约20%。华为数据显示,基于灵衢的单集群可支持100万颗AI处理器,10万卡集群的模型浮点算力利用率从20%提升至35%。

通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解

AI Agent时代,通信正成为算力“胜负手”。模型参数从万亿级走向10万亿级,未来或达50万亿;上下文从几K级来到几M级。计算系统面临三大挑战:一是通信量平方级暴涨,典型MoE模型在10万卡集群上MFU不到20%;二是AI负载多样化,Prefill与Decode特征不同,需异构算力协同与内存池化;三是上下文变长带来存储压力,需构建HBM、DDR、SSD多级缓存,现有PCIe加RoCE网络难以满足时延与带宽需求。

灵衢的核心是用一套协议贯穿芯片到集群,统一内存语义,消除协议转换开销。其竞争力包括四方面:协议归一,互联带宽从百GB级提升到TB级,RTT时延从7微秒压缩至2微秒,降低约70%;多样算力异构协同,CPU、NPU、内存、SSD对等互联,灵活配比;分级存储全局池化,提高内存利用率;光电互联灵活组网,4096卡超节点需56个计算柜和14个灵衢互联柜,最长传输距离超200米,单超节点从1024卡扩展到4096卡,最终单集群支持100万颗AI处理器。

通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解

基于灵衢,华为构建了AI Agent超节点集群。昇腾960超节点单节点可实现4096卡规模,最大提供8 EFLOPS FP8算力、1PB HBM容量,系统可用度达99.8%,风冷和液冷版本将分别于2027年Q2和Q3上市。柜内灵衢交换刀片支持172T带宽,实现72个昇腾处理器和18个鲲鹏处理器互联;跨柜灵衢交换设备拥有176个端口,每端口1.6T,单机280T全光互联;UBG灵衢网络交换机拥有1024超大Radix扇出能力,支持百万卡集群。

鲲鹏950超节点计算刀片提供384个CPU核和6TB内存,单柜支持192TB内存,可实现超150万核统一调度、24000TB内存全局池化。昇腾960计算刀片支持8颗NPU,提供32 PFLOPS FP4算力、4.5TB统一内存、17.9TB/s灵衢互联带宽。OceanStor M900实现网络、CPU、盘控芯片“三芯合一”,单ASU模组64TB容量密度,单节点访问带宽480GB/s。三类硬件通过灵衢统一协议灵活配置,实现“1+1+1>3”。

通信墙不破,AI Agent算力不立!华为超节点“黑科技”详解

中小场景方面,Atlas 650E可通过双机灵衢直连,让16个NPU进行Full-Mesh组网,无需交换机,支持万亿参数模型,推理吞吐提升40%以上,时延低至10毫秒,未来可平滑扩容。

生态方面,华为CANN全面开源开放,社区月活开发者已达5200多人。

标签: AI 资讯 AI

更多推荐阅读

Astra两周抢走13%份额,Anthropic或提前发新模型

Astra两周抢走13%份额,Anthropic或提前发新模型

路透社独家报道,Anthropic 正在考虑提前发布新模型。此前,Anthropic 于 9 月 1 日发布 Fable 5.1,号称“最强编程与知识工作模型”,并将缓存读取价格下调 75%,试图以性价比稳住企业客户。但 OpenAI 于 9 月 3 日发布 Astra,Sam Altman 表示正努力尽快将 Astra 交付给每个人。 Anthropic 面临切实的份额流失。OpenRoute...

2026-09-20
华为发布昇腾960芯片路线图:一年一代,打造AI算力底座

华为发布昇腾960芯片路线图:一年一代,打造AI算力底座

华为全联接大会公布芯片时间表:昇腾960DT研发提前三个季度,单芯片算力倍增,支持2 PFLOPS FP8、4 PFLOPS FP4,HBM容量最高288GB、带宽9.6TB/s。昇腾960超节点达4096张NPU卡,最高8 EFLOPS FP8算力、超1PB HBM容量。轮值董事长汪涛公布路线:2028年昇腾970、2029年昇腾980,未来几年保持“一年一代”。他表示,这是国内半导体制造、封装...

2026-09-20
GPT-6不为用户训练?OpenAI研究员曝真实目标

GPT-6不为用户训练?OpenAI研究员曝真实目标

OpenAI核心研究员Noam Brown在Astra发布当天接受访谈,披露了公司训练新模型的真实目标与内部进展。 Brown表示,OpenAI训练新模型的头号目标是“递归自我改进”,且进度已领先第二名一大截。服务用户只是副产品,制造“下一代研究员”才是核心。在优先级序列中,软件工程与内部算力迭代深度绑定,获得最顶级资源;创意写作等无法帮助训练更强机器研究员的能力则靠后。即便分出精力做法律金融,...

2026-09-20
视觉记忆如何驱动物理AI自进化?对话Memories.ai沈俊潇

视觉记忆如何驱动物理AI自进化?对话Memories.ai沈俊潇

2024年,前Meta现实实验室研究员沈俊潇与周恩民在硅谷创办Memories.ai,瞄准尚未被探索的视觉记忆领域。2025年7月,公司结束隐身模式,发布全球首个大型视觉记忆模型(LVMM),并完成800万美元种子轮融资。此后种子轮追加至1600万美元,与高通、英伟达建立合作,2026年1月在国际消费电子展发布LUCI开发者硬件平台,并从Meta挖来首席AI官。 公司保持精简团队,沈俊潇招人更看...

2026-09-20
数学界“世界之窗”向算法打开:AMS会刊刊发赵辉博士整体几何结构研究

数学界“世界之窗”向算法打开:AMS会刊刊发赵辉博士整体几何结构研究

数学界的“世界之窗”向算法打开。美国数学会会刊《Notices of the American Mathematical Society》2026年10月刊(第73卷第9期)刊发题为《Global Geometric Structures: From Abstraction to Construction, Visualization, and Applications》的邀稿Feature Ar...

2026-09-20
诺奖得主提出爱因斯坦测试:AI能否仅凭1911年知识独立提出相对论

诺奖得主提出爱因斯坦测试:AI能否仅凭1911年知识独立提出相对论

诺奖得主、Google DeepMind联合创始人哈萨比斯提出一个设想:如果把AI送回1911年,只让它掌握爱因斯坦当时能了解的知识,它能否在1915年提出相对论?他想考察的是,AI能否仅凭当时的知识水平,自主提出新的解释框架,完成超出训练材料的推理,而非复读答案。Nature将这类测试称为“爱因斯坦测试”。 今年3月,独立研究者Michael Hla把知识截止时间提前到1900年,从零训练了3...

2026-09-20
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部