OpenAI太贵,美国大厂转投中国开源模型

OpenAI太贵,美国大厂转投中国开源模型

AI 资讯 来源:新闻/公众号 发布时间:2026-10-02 更新于 2026-10-02 预计阅读 7 分钟

企业AI正进入模型分流阶段,中国开放模型正在吃下美国企业的AI降本红利。OpenAI、Anthropic开始被客户嫌贵。不只是硅谷创业公司,AT&T这样的电信巨头也把约40%的AI工作负载放到开放模型上,并计划一年内提高到70%。AT&T每天处理450亿Token,在这一规模下,每百万Token便宜一点,反映到财务报表上都很可观。于是,一批原本主要调用OpenAI、Anthropic前沿模型的美国企业,开始把越来越多任务迁移到开放权重模型上,其中越来越多地使用中国AI公司提供的开放模型。据《金融时报》报道,今年以来企业对开放模型的讨论和实际调用量明显增长,当前开放权重模型市场最活跃的玩家正来自中国,DeepSeek、智谱等公司开始出现在美国企业重新计算AI成本的账单里。

OpenAI们被嫌死贵,美国大厂转向开源模型,中国成最大赢家

Tinder CTO Vinay Kuruvila透露,今年1月按当时AI使用规模估算全年支出约100万美元,到7月已变成1000万美元/年,半年涨了10倍。Tinder已开始把部分普通用户请求转给开放权重模型处理。对很多企业任务来说,问题已从“哪个模型最聪明”变成“这个任务值不值得调用最贵的模型”。Kuruvila认为,OpenAI Astra和Anthropic Claude Fable等前沿模型对Tinder约90%的任务已足够。一旦开放模型进一步追近,企业继续为这部分能力支付溢价的必要性就会下降。企业AI正进入更细的模型分流阶段:最难任务继续交给最强模型,大量重复、明确、容错边界清晰的任务流向更便宜模型。

OpenAI们被嫌死贵,美国大厂转向开源模型,中国成最大赢家

AT&T首席数据与AI官Andy Markus解释,在这样的调用量级下,成本已成为模型选择的关键变量。如果任务可从昂贵闭源模型迁移到开放模型,同时准确率没有明显下降,公司自然会迁移。AT&T并非简单下载开源模型直接使用,还会利用专有数据调优,在一些特定任务中,经过企业数据优化后的开放模型效果甚至可与闭源模型相当乃至更好。开放模型对企业最有吸引力的一点是,它可以被企业改造成自己的模型。参数开放后,企业可自己部署、微调,不必每次调用都支付Token费用。如果企业本就拥有大量算力、数据和工程团队,这笔账尤其容易算过来。

OpenAI们被嫌死贵,美国大厂转向开源模型,中国成最大赢家

AlphaSense统计显示,今年8月和9月,美国企业在业绩电话会和投资者会议中提到open weight或open source模型的次数,比去年同期增加6倍。讨论这些模型的企业已从科技行业扩散出去,PNC Financial Services、物流公司CH Robinson、工业巨头Siemens最近都公开谈到开放模型的使用。真正值得注意的是模型调用数据。今年8月,在Vercel AI Gateway上处理的所有Token中,56%已来自开放权重模型,去年12月这一比例还只有7%,不到一年从7%涨到56%。OpenRouter上也出现类似趋势,按Token调用量统计,排名靠前的模型中,来自中国实验室的开放模型已占据相当醒目的位置。企业对开放模型的兴趣已同时出现在财报电话会和真实Token消耗中。

现在全球开放权重模型市场中,一股绕不开的力量来自中国,DeepSeek、智谱等中国公司已成为这一赛道的重要玩家。此外,法国Mistral,以及美国的Nvidia、Reflection AI、Thinking Machines Lab也在推出开放程度较高的模型。这些公司的商业模式和OpenAI、Anthropic并不完全相同。对OpenAI和Anthropic来说,最先进的闭源模型本身就是核心商品,用户使用一次就支付一次API成本。开放模型玩家则有更多选择:有的通过Token API收费,有的免费提供模型以扩大生态和开发者覆盖,还有厂商可通过模型带动芯片、云服务或其他产品销售。因此,当企业开始对AI成本越来越敏感时,开放模型可以把价格压到完全不同的水平。尤其对可自行部署的企业来说,Token API甚至都可以跳过,模型下载下来跑在自己的基础设施上。这也是为什么开放权重模型正从开发者社区里的选择,逐渐变成企业CIO和CTO账本上的选择。

不过,企业拥抱开放模型并不完全因为便宜。Digital Realty高级全球解决方案架构总监Scott Wallace提到另外两个原因:数据主权和安全。Digital Realty已搭建自己的内部聊天系统,底层运行开放权重模型。公司会根据不同任务的敏感程度,在开放模型和商业闭源模型之间切换,其中一些企业内部数据只会进入部署在私有基础设施上的模型。Wallace说,客户数据不会进入外部的前沿模型。这揭示出企业AI的另一个趋势:过去大家关注最强模型是哪一个,但到了真正部署阶段,企业考虑的是一整套问题——成本多少、数据放在哪里、模型能不能定制、延迟多高、是否可以私有化,以及出了问题之后自己能控制多少。在这些维度上,开放模型天然拥有一些不同于闭源API的优势。

当然,现在谈企业全面抛弃OpenAI和Anthropic还远远过早。目前两家公司依然拿走企业AI支出中的很大一部分,最复杂的编码、推理、研究和Agent任务,企业仍高度依赖前沿模型。这些模型对算力的大规模需求,也仍支撑着全球数据中心建设热潮。但变化已经出现。过去企业可能倾向于把各种任务全部接入最强模型,现在越来越多公司开始拆任务:哪些任务必须用最强模型?哪些任务用次一级模型就够了?哪些任务可以直接交给本地部署的开放模型?一旦AI调用量从每天几百万Token增长到几十亿、几百亿Token,这种模型路由就不再是工程细节,而会直接变成成本问题。对OpenAI和Anthropic来说,这可能比又出现一家参数更大的竞争对手更棘手。因为企业做这个决定时,摆在面前的未必是一张Benchmark,更可能是一张Excel表,表里的最后一

标签: AI 资讯 AI

更多推荐阅读

数据公司闷声发财:成立不到一年估值25亿美金

数据公司闷声发财:成立不到一年估值25亿美金

去年还被认为估值飙升过快的AI应用明星公司,今年在数据公司面前已显得平常。一批成立不满一年的数据公司中,已诞生估值25亿美元的UniPat,以及多家估值3至8亿美元的公司。AI应用、硬件、具身、世界模型等领域的讨论热度有所消退,唯独数据公司一提就让人来劲。与以往创投明星不同,这批数据公司和创始人渴望低调,据说创始人之间达成默契:只PR技术实力,对团队和业务保密,对媒体主要诉求是“求别写”。 这行...

2026-10-02
卸载CC Switch,换上Magpie:统一模型入口更省心

卸载CC Switch,换上Magpie:统一模型入口更省心

已卸载 CC Switch,改用 Magpie。原因有两点:一是 CC Switch 功能越堆越多;二是它只能切换配置,而 Magpie 解决的是统一模型入口。 换上 Magpie 后没有使用交互难度。它向下兼容 CC Switch 的模型配置功能,同样可以配置 Claude Code、Codex、Gemini CLI,分别设置 API 地址、Key、模型,管理配置文件并快速切换。 Magpi...

2026-10-02
首发!openJiuwen WorkSwarm全双工多模态交互上线

首发!openJiuwen WorkSwarm全双工多模态交互上线

AI助手正在进入一种新的工作节奏:一边对话,一边调用工具办事。近期Gemini Live更新将后台工具调用放入实时交互,助手可以先回应“我查一下”,再继续处理耗时工作。这带来一个问题:工具任务运行时,AI还能否继续接话? 理解此事需先理解“全双工”。传统语音助手像对讲机,用户说完AI才接话,AI说话时用户插话会被打断或忽略。全双工则像打电话,AI可边听边说,用户能随时打断、补充,对话不再严格按回...

2026-10-02
Anthropic营收狂飙12倍,1/4靠两大神秘客户

Anthropic营收狂飙12倍,1/4靠两大神秘客户

据路透社消息,招股书显示Anthropic约1/4营收来自两家神秘大客户,各占12%。2025年其营收飙升至原来的12倍,接近46亿美元,按此计算两家客户分别贡献约5.52亿美元,合计约11.04亿美元。这意味着任一家客户采购变化都会影响超十分之一年度收入,可能降低收入稳定性及议价能力。此前The Information报道称,Anthropic年化收入约40亿美元时,前两大客户合计贡献约12亿美...

2026-10-02
能斗舞的机器人7.9万起,银河星仔ET1价格公布

能斗舞的机器人7.9万起,银河星仔ET1价格公布

能跟人类舞者Battle的机器人来了。银河通用推出全自研物理世界原生智能体银河星仔ET1,专为人形机器人实时多模态交互和运动打造,共三个版本:基础版7.9万元,专业版13.9万元(搭载Nano 40TOPS),旗舰版17.9万元(搭载NX 100TOPS),起售价比外界预期的20万元低不少。 当前人形机器人市场存在明显价格鸿沟:消费级约2万—3万元,准专业级约8万—12万元,专业级约12万—20...

2026-10-02
平遥古城36小时AI短片黑客松,贾樟柯当评委

平遥古城36小时AI短片黑客松,贾樟柯当评委

朋友圈里,有人新疆自驾,有人海岛躺平。而我,带薪杀到平遥古城,看一群创作者把自己塞进36小时倒计时,用AI现场拍短片。 LibTV联动抖音AI创作浪潮计划,发起「X小时之后」主题AI短片黑客松。规则简单粗暴:36小时,30+个队伍,自由组队,现场创作,最后交片。活动设置覆盖创意、叙事、视觉呈现等维度9大奖项,奖金3万元到20万元不等。贾樟柯亲自做评委,现场聊了他怎么看AI内容创作,以及AI会怎么...

2026-10-02
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部