北京杭州深圳跻身AI城市前三,算力缺口近3万亿
到2031年,人工智能预计将累计创造22.5万亿美元全球经济价值。预计到2030年,全球AI算力缺口将达3809亿美元。2026年中国智能体部署渗透率达81.0%,全球领先。2026年中国人工智能城市排行榜中,北京、杭州、深圳位居前三。
这些数据来自IDC与浪潮信息联合发布的首份智能体基础设施研究报告《2026年中国人工智能计算力发展评估报告》。报告指出,Agent正在重塑一切,带来算力饥荒与行业大洗牌。

OpenAI披露,其内部模型在24天内攻破超100个世界级数学难题,背后是智能体协作。为解决NS方程相关问题,10000个并发智能体耗时约88小时,互发490万条消息,消耗约3000亿输出Token。其中核心阶段发送270万条消息,耗费1300亿Token,随后17小时完成Lean形式化与验证。3000亿Token相当于超20万套《三体》内容量,而普通人一辈子说话约相当于6亿Token。GPT-3训练时也使用了3000亿Token,如今一个多智能体科研任务累计消耗即达同等量级。
黄仁勋在英伟达GTC大会定下基调:每家公司都需要智能体战略。中国智能体部署渗透率今年达81.0%,高于全球领先水平的78.1%。但过去为训练场景囤积的旧算力卡可能变成“废铁”。AI算力评价标准已从“算力规模”转向“Token生产效率”。

Agent与聊天机器人根本不同:需多轮推理、调用工具、跨系统协作并保存记忆,带来恐怖乘数效应。IDC预计到2030年,全球活跃智能体数量复合增长率129.8%,但Token消耗复合增长率高达4822.6%,是前者37倍。未来4年智能体数量可能几十倍增长,Token消耗则是数百万倍增长。
IDC数据显示,中国智能算力规模2025年达1371.1 EFLOPS,2026年预计增至2576.5 EFLOPS、同比增长87.9%,2030年达10524.3 EFLOPS,2025—2030年复合增长率50.3%,较上一版本预测的46.2%显著上调。通用算力2025年为85.8 EFLOPS,2026年预计增至102.1 EFLOPS、同比增长19.0%,2030年达291.2 EFLOPS,复合年均增长率27.7%,高于上一版本预测的18.8%。

但存在严重结构性错配:有GPU不等于有适合智能体的算力。旧卡多面向训练,追求峰值算力;Agent推理追求超大容量上下文保存、低时延和高吞吐。中低端卡显存不足,存不下几十万Token长链路记忆,商业价值几乎为零。同时,高端芯片、HBM、服务器CPU等产能扩张周期远长于AI需求爆发节奏,投资额成倍增长无法等比例转化为真实算力供给。能源约束更使矛盾雪上加霜,电网扩容需数年,远慢于算力建设周期。IDC预测到2027年全球AI算力需求满足率将跌至71%,近三成需求无法满足。
AI基础设施正经历系统性重构,从“堆卡”转向任务级系统协同优化。竞争核心是高效持续生产Token,实现计算、存储、网络、终端及模型、调度和Token运营全系统协同。客户采购从买服务器、GPU时长升级为购买模型能力与Token产出。未来计算产业裂变为“能力型智算”与“容量型智算”两条路线:前者依靠超节点、高速互连突破智能上限;后者通过多元算力协同、推理解耦提升Token产出效率,降低单位智能成本。
各行业智能体落地成熟度差异巨大。Coding和Work智能体已全面规模化应用,而制造、医疗、能源、电力等实体行业进入核心业务并形成完整闭环的比例仍为0%,主要受制于试错成本与结果验证难题。
更多推荐阅读

平头哥真武V900发布:AI算力从单卡走向千卡互联
从真武 V900 到新一代磐久超节点服务器,平头哥八年来布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。9 月 22 日 2026 杭州云栖大会上,平头哥被完整推到主论坛台前,副总裁高慧发表题为「Agentic 时代卓越算力基石」的演讲,发布从真武 V900 芯片到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、...
2026-09-23
陆川用AI五天复原明代大爆炸,阿里全模态模型兜底影视生产
不用搭景,不用等演员,导演陆川和团队用AI把一场400年前的明代灾难现场做了出来。宫廷、火药库,以及史料中烟云如黑灵芝的大爆炸,按传统影视工业做法往往需要数月时间和千万级投入,这次只用了5天。 人物的脸、皮肤、神态已相当逼真,爆炸的烟尘、碎片、火光也稳稳接住。过去光是一场爆炸戏就要耗费19天。陆川团队把史料文字翻译成现代视觉概念,前后做了约四轮提示词优化,再参考真实爆炸影像校准。阿里视频生成模型...
2026-09-23
OpenAI新模型24天攻克100+数学难题
数学界正被AI迅速逼近。OpenAI一篇重磅博文披露,一款8月28日才开始训练的内部新模型,已攻克100多道世界级数学难题,横跨数学大部分领域,其中包括困扰学界多年的“纳维–斯托克斯”千禧年难题。从开训到9月21日官宣仅24天,进化速度令OpenAI内部数学家都感到意外。 9月8日,OpenAI称该内部模型在88小时内攻克NS千禧年难题,给出NS方程存在性与光滑性问题的证明,并公开166页论文和...
2026-09-23
国产AI生图新高度:真假难辨,还能精修到商用
两张图都是AI生成的,来自商汤科技正式上线的SenseNova U1 Pro,目前可在商汤小浣熊平台使用,API已向企业客户开放。 实测在SenseNova Studio平台进行,模型支持2K起步、最高4K清晰度。第一轮测试将一张生活照重构为纸质风格,随后仅修改人物外套内的黑色圆领T恤为白色,要求严格限定在可见内搭区域。由于T恤、皮带、裤子均为黑色且有胸牌遮挡,边界易混淆,但U1 Pro精准拿捏...
2026-09-23
剪映发布全新AI创作能力:从专业剪辑到普通用户全面提效
剪映在2026 AI新创作发布会上发布全新AI能力,覆盖PC专业版与App端,分别聚焦“提效”与“省心”。 PC专业版推出剪映Hub,一站式AI创作平台,将AI创作与多轨道剪辑连接,让脚本、素材与创作上下文在同一项目中延续,减少跨工具切换的断点与重复操作。剪映助手Agent介入专业创作流程,承担素材整理、粗剪、包装等工作,可根据创作目标规划任务、串联模型工具并自动运行,用户也可自定义工作流,沉淀...
2026-09-23
AI操控游戏新选择:Jev模型到底能做什么?
Jev 是 TypeSafe AI 推出的决策模型,创始人 Diogo Almeida 曾在 OpenAI 参与指令跟随与对话研究。TypeSafe 开发两年后发布该系统,官方称为 System One Models。其使用方式是把当前情况和问题输入,模型返回程序可直接使用的结果,本质上是分类模型,接口主要有三种类型。 在游戏场景中,可每一步询问它:当前血量、怪物和金币位置、出口位置,目标是拿金...
2026-09-23