中国最强AI芯片发布,平头哥再开源软件栈

中国最强AI芯片发布,平头哥再开源软件栈

AI 资讯 来源:新闻/公众号 发布时间:2026-09-27 更新于 2026-09-27 预计阅读 4 分钟

9月22日云栖大会上,阿里巴巴CEO吴泳铭介绍新一代真武V900,称其是目前中国算力性能最强的AI芯片,性能达M890的3倍。但客户换用真武,还需确认原有代码、工具和开发经验能否迁移。芯片之外,软件生态同样决定客户选择。

亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源

9月23日,平头哥公布AI软件栈T-Head SAIL最新开源进展,扩大框架适配、加速库、工具链和通信库等开放范围。平头哥将AI芯片比作发动机,软件栈则是“变速箱+传动系统+驾驶系统”。真武AI芯片已服务20多个行业650多家客户,蚂蚁、小红书、小鹏汽车等已使用T-Head SAIL。小红书还基于其开源代码开发了模型迁移与算子优化Agent,加速生成式推荐模型部署。

亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源

T-Head SAIL是平头哥围绕真武打造的类“CUDA”软件栈,连接PyTorch等上层框架与底层硬件,负责模型迁移、编译执行、计算加速和开发调试。今年7月WAIC上,平头哥宣布启动开源,提供SDK、驱动、性能分析与调试工具及文档下载。此次进一步开源PyTorch-for-sail、sailify、Triton-for-sail、DeepGEMM-for-sail、FlashAttention-for-sail等项目,让开发者可查看、修改代码。

亮出“中国最强AI芯片”还不够,平头哥又甩出一手开源

这些工具回应了开发者三大关键问题:一是迁移成本。平头哥半导体软件生态资深总监陆生华表示,最大诉求是迁移成本有多大。框架适配、源码迁移和算子开发工具,旨在保留客户积累,让开发者沿用熟悉方式,由工具辅助处理已有代码。二是性能优化。迁移跑通只是第一步,若效率只剩30%-40%,业务难以接受。计算加速项目开源后,开发者可自行定位和优化性能。三是新模型支持。截至2026年9月,平头哥在ModelScope上已提供39个量化模型,覆盖Qwen、DeepSeek、Kimi等,累计下载超34.8万次。TensorFlow、JAX适配版本、自研推理引擎及PCCL、DeepEP-for-sail等通信组件也在推进开源。

客户实践中,小鹏借助SAIL将原GPU平台业务模型迁至真武云端集群,开展智能驾驶模型训练,并利用性能分析工具优化。蚂蚁基于SAIL在真武810E和M890上完成主要前沿模型推理适配,继续推进量化、推理阶段分离等工作。小红书则开发了迁移与算子优化Agent,将模型经验和业务需求写进工具。陆生华提到,客户想开发高性能算子又需保护算法知识产权,开放代码后客户可自行完成,核心逻辑留在内部,愿意公开的提交社区。T-Head SAIL已建立贡献流程,已有阿里内部和外部客户提交代码。

平头哥从2019年含光800、2021年倚天710走到真武系列,路径是从业务需求出发设计芯片,先在阿里内部验证,再服务外部客户。陆生华称,外部客户常先确认阿里自己是否用过。淘宝、搜索、推荐、广告等业务承担早期验证。到真武M890,团队已完成两代完整芯片交付。650多家客户意味着产品得到使用,也带来更多不同问题。此时扩大开放,既有验证过的软件,也有愿意继续开发的用户。此外,将适配提交回PyTorch、vLLM、Triton等上游社区,可让真武支持随主流软件演进,减少重复维护。

标签: AI 资讯 AI

更多推荐阅读

模型不够强,灵巧手才要卷性能?源升智能杨思成谈机器人操作

模型不够强,灵巧手才要卷性能?源升智能杨思成谈机器人操作

灵巧操作的最高境界,是“无剑胜有剑”。在源升智能创始人杨思成看来,灵巧手之于机器人操作能力,就像兵刃之于剑术,模型越强,就越不依赖末端执行工具;反之,模型能力不够强时,就需要灵巧手加持才能更好完成任务。 杨思成在清华时期便专门研究灵巧操作,2018年加入腾讯Robotics X实验室,担任灵巧手项目总负责人。2024年,他成立源升智能,开启灵巧手创业。他认为,现在行业都在打造“神兵利器”——更多...

2026-09-27
华为大模型双子星创业,要做物理世界的Scaling Law

华为大模型双子星创业,要做物理世界的Scaling Law

数亿元资金,投向了一场物理世界的基模实验。Physical AI创业公司息壤开物宣布,已连续完成数亿元种子轮及天使轮融资,由敦鸿资产领投,华控基金、三花控股、银杏谷资本、泽然资本、本坚基金、天使基石、标朴投资等跟投,估值达5亿美金。 公司创始人、CEO李寅,前华为云大模型CTO,华为大模型0-1阶段核心成员;联合创始人张含望教授,前华为多模态首席科学家。二人联手,瞄准具身智能尚未解决的底层难题:...

2026-09-27
前OpenAI研究员:Jev出现前AI世界是悲剧

前OpenAI研究员:Jev出现前AI世界是悲剧

“它会逐渐退到软件背景中,像数据库、正则表达式或其他基础设施一样,成为开发者随手调用的普通能力。”这是 TypeSafe CEO、Jev 创始人 Diogo Almeida 对 AI 的设想:当智能真正融入软件,用户甚至不必意识到它的存在。但怎样才能让开发者放心地把判断交给 AI,而不用守在旁边反复检查? 几个月前,在 AI Engineer 大会的演讲中,这位曾参与 OpenAI Instru...

2026-09-27
Opus 5.5与GPT-6被指偷师中国AI团队

Opus 5.5与GPT-6被指偷师中国AI团队

所谓“天下文章一大抄”。刚发布的Opus 5.5和GPT-6 Luna,身上满是姚顺雨和梁文锋的影子。两家公司预训练已做到极致,为提升智能、降低算力成本,都选择开辟新战场:Opus 5.5对上下文动手,GPT-6 Luna对缓存动手。 **阿莫迪偷师姚顺雨** 在Artificial Analysis智能指数中,Claude Opus 5.5在max档位下平均每题输出11.9万token,其中...

2026-09-27
OpenAI Codex负责人揭秘:从内部工具到顶流,终极目标不只是写代码

OpenAI Codex负责人揭秘:从内部工具到顶流,终极目标不只是写代码

过去两年,AI编程最明显的变化,不是“代码写得更快”,而是软件开发本身正在被重新定义。从只能补全几行代码的Copilot,到今天能读懂代码库、调用工具、执行测试、提交修改,甚至持续运行数小时乃至数天的Coding Agent,模型正从“辅助工程师写代码”进入软件工程的完整生命周期。真正变化的已不只是效率,而是人和代码之间的关系:当正确性检查、安全审查、依赖升级、重构乃至部分架构工作逐渐自动化,人类...

2026-09-27
蚂蚁清华开源9B模型Realtime-Venus:AI边聊边办事

蚂蚁清华开源9B模型Realtime-Venus:AI边聊边办事

AI实时交互存在一个常见难点:查资料、跑任务需要时间,用户却常在此期间继续追问或补充信息。如何边处理任务边听懂并回应用户新需求,是对AI助手的一大考验。近期,TML-Interaction-Small、SeedRealtime及Qwen-Omni-Realtime相继推出闭源方案。蚂蚁AI安全实验室与清华大学人机交互实验室联合发布Realtime-Venus,通过开放模型权重与代码,将全双工交互与...

2026-09-27
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部