平头哥真武V900发布:AI算力从单卡走向千卡互联

平头哥真武V900发布:AI算力从单卡走向千卡互联

AI 资讯 来源:新闻/公众号 发布时间:2026-09-23 更新于 2026-09-23 预计阅读 5 分钟

从真武 V900 到新一代磐久超节点服务器,平头哥八年来布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。9 月 22 日 2026 杭州云栖大会上,平头哥被完整推到主论坛台前,副总裁高慧发表题为「Agentic 时代卓越算力基石」的演讲,发布从真武 V900 芯片到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、倚天 CPU 路线图及超节点服务器的产品组合。背后是 Agentic 时代负载变化:算力需求从训练走向推理增长,应用从单轮请求变成连续多步任务,硬件竞争从单芯片指标扩展到整个计算系统协同。

从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局

真武 V900 是分量最重的产品,搭载 216GB 显存,片间互联带宽 1200GB/s,单芯片性能是上一代 M890 的 3 倍,原生支持 FP8 和 FP4。V900 计划 2027 年 Q1 量产销售,2028 年 Q3 推出真武 J900。上一代 M890 于 2026 年 5 月发布,拥有 144GB 显存和 800GB/s 互联带宽,性能是 810E 的 3 倍。2024 年的 810E 已从单一推理芯片走向训推一体。三代产品持续提升训练、推理、显存和低精度计算能力。

从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局

模型进入万亿参数后,MoE 成为默认架构,将模型拆成大量专家,每个 Token 只调用一部分,缓解计算量但把硬件压力推向算力、显存和互联三个方向。单颗 M890 有 144GB 显存,V900 提升至 216GB,只需 10 多张 V900 即可部署万亿规模大模型。基于 M890 的超节点已大规模应用,跑通 Qwen3.8、Kimi K3 等超 2 万亿参数模型。万亿参数模型必须拆到多颗芯片上,芯片间通信速度直接影响模型运行效率。今年 5 月 ICN Switch 首次亮相,真武 V900 通过其连接后的超节点具备原生内存语义和内存统一编址能力,可实现千卡全带宽高速互联,让上千颗 V900 像一颗超级芯片协同工作。

从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局

真武系列客户半径不断增长。具身智能领域,众擎机器人基于真武搭建千卡训练平台,端到端训练效率提升 34%,30 多个模型免适配直接跑通。汽车场景,小鹏将真武用于自动驾驶、智能座舱和企业大模型,整机性能相比业界主流 GPU 提升 70%,集群故障数量减少 50%。截至目前,真武系列已服务超过 650 家企业客户。

平头哥还将磐脉智能网卡、镇岳 SSD 主控及倚天 CPU 放进同一张产品图。真武承担 AI 计算,ICN Switch 负责 AI 芯片间高速互联,磐脉进入服务器与数据中心网络,镇岳负责 SSD 控制,倚天处理通用计算。Agent 场景下 CPU 持续被占用,Intel 曾测算前沿模型训练中一颗 CPU 约搭配 8 颗 GPU,Agentic AI 负载下 CPU 密度向 1:1 甚至更高变化。倚天路线图显示,2027 年推出倚天 720 和 730,720 为 190 核、12 通道 GDI、96Lane PCIe,面向吞吐并发型场景;730 为第一代自研高性能核,支持两路同步、多线程、128Lane PCIe,单核性能最高达上一代 1.4 倍,面向延迟敏感型场景。未来还将推出基于第二代自研核心的倚天 750,可与真武通过同一套高速互联体系交换数据。

软件配套方面,Kimi K3 适配真武 M890 过程中,基于 64 张 M890,团队继续调整软件栈和核心算子,实现首 Token 时延下降约 35%,单卡解码吞吐提升 1.8 倍。今年 7 月平头哥开放的 SAIL 软件栈起关键作用,覆盖操作系统、SDK 和接口层,提供驱动、性能分析和调试工具。SAIL 已支撑 260 多个主流训练和推理框架,在 Github 上 15218 个超过 1 亿 star 的主流 AI 仓库中覆盖超过 96%,vLLM、SGLang 等主流推理框架从上游开源新版本到 SAIL 完成全量适配平均不超过 1 周。阿里拥有模型、芯片、推理平台和云的完整链条,可针对模型实现从芯片到云平台的全链路优化,显著提升推理效率、大幅降低推理成本。

标签: AI 资讯 AI

更多推荐阅读

陆川用AI五天复原明代大爆炸,阿里全模态模型兜底影视生产

陆川用AI五天复原明代大爆炸,阿里全模态模型兜底影视生产

不用搭景,不用等演员,导演陆川和团队用AI把一场400年前的明代灾难现场做了出来。宫廷、火药库,以及史料中烟云如黑灵芝的大爆炸,按传统影视工业做法往往需要数月时间和千万级投入,这次只用了5天。 人物的脸、皮肤、神态已相当逼真,爆炸的烟尘、碎片、火光也稳稳接住。过去光是一场爆炸戏就要耗费19天。陆川团队把史料文字翻译成现代视觉概念,前后做了约四轮提示词优化,再参考真实爆炸影像校准。阿里视频生成模型...

2026-09-23
OpenAI新模型24天攻克100+数学难题

OpenAI新模型24天攻克100+数学难题

数学界正被AI迅速逼近。OpenAI一篇重磅博文披露,一款8月28日才开始训练的内部新模型,已攻克100多道世界级数学难题,横跨数学大部分领域,其中包括困扰学界多年的“纳维–斯托克斯”千禧年难题。从开训到9月21日官宣仅24天,进化速度令OpenAI内部数学家都感到意外。 9月8日,OpenAI称该内部模型在88小时内攻克NS千禧年难题,给出NS方程存在性与光滑性问题的证明,并公开166页论文和...

2026-09-23
国产AI生图新高度:真假难辨,还能精修到商用

国产AI生图新高度:真假难辨,还能精修到商用

两张图都是AI生成的,来自商汤科技正式上线的SenseNova U1 Pro,目前可在商汤小浣熊平台使用,API已向企业客户开放。 实测在SenseNova Studio平台进行,模型支持2K起步、最高4K清晰度。第一轮测试将一张生活照重构为纸质风格,随后仅修改人物外套内的黑色圆领T恤为白色,要求严格限定在可见内搭区域。由于T恤、皮带、裤子均为黑色且有胸牌遮挡,边界易混淆,但U1 Pro精准拿捏...

2026-09-23
剪映发布全新AI创作能力:从专业剪辑到普通用户全面提效

剪映发布全新AI创作能力:从专业剪辑到普通用户全面提效

剪映在2026 AI新创作发布会上发布全新AI能力,覆盖PC专业版与App端,分别聚焦“提效”与“省心”。 PC专业版推出剪映Hub,一站式AI创作平台,将AI创作与多轨道剪辑连接,让脚本、素材与创作上下文在同一项目中延续,减少跨工具切换的断点与重复操作。剪映助手Agent介入专业创作流程,承担素材整理、粗剪、包装等工作,可根据创作目标规划任务、串联模型工具并自动运行,用户也可自定义工作流,沉淀...

2026-09-23
AI操控游戏新选择:Jev模型到底能做什么?

AI操控游戏新选择:Jev模型到底能做什么?

Jev 是 TypeSafe AI 推出的决策模型,创始人 Diogo Almeida 曾在 OpenAI 参与指令跟随与对话研究。TypeSafe 开发两年后发布该系统,官方称为 System One Models。其使用方式是把当前情况和问题输入,模型返回程序可直接使用的结果,本质上是分类模型,接口主要有三种类型。 在游戏场景中,可每一步询问它:当前血量、怪物和金币位置、出口位置,目标是拿金...

2026-09-23
阿里云栖大会:吴泳铭为何用经济学讲AI未来

阿里云栖大会:吴泳铭为何用经济学讲AI未来

9月22日,杭州云栖大会,阿里巴巴集团CEO吴泳铭发表开场主旨演讲。过去几年,云栖大会演讲常被视为技术风向标,但这次吴泳铭花了很多时间讲工业革命、电和经济学,重心不在AI会变成什么样,而在AI会让世界变成什么样。他提出核心观点:上一次类似变化是工业革命把动力变成规模化商品,人类发明蒸汽机、内燃机和电,并围绕它们建立现代产业,这一次轮到思考。当一个CEO用经济学语言描述未来,说明他思考的已不仅是产品...

2026-09-23
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部