Grok 4.7发布即全球第三,马斯克:4.8也训完了

Grok 4.7发布即全球第三,马斯克:4.8也训完了

AI 资讯 来源:新闻/公众号 发布时间:2026-09-22 更新于 2026-09-22 预计阅读 4 分钟

SpaceXAI正式发布全新主力模型Grok 4.7,主打同价同速下性能大幅提升。马斯克称其将SpaceXAI送上智能体编程第三把交椅,仅次于Anthropic和OpenAI。官方定位为“史上最强Grok,专为编程和知识工作而生”。

Grok 4.7上线,全球第三!马斯克:4.8也训完了

Grok 4.7输入每百万Token 2美元、输出6美元,与Grok 4.6一致,但底层模型彻底换血:基座更大、强化学习训练拉长,任务难度加权向“需数小时完成的工作”倾斜。官方称其在编程和知识工作基准上几乎盖过GPT-5.6 Sol Max,直追Fable 5.1 Max。

Grok 4.7上线,全球第三!马斯克:4.8也训完了

编程测试数据分化明显。综合智能指数上,Grok 4.7得46分,较4.6仅涨2分,第一梯队Fable 5.1和GPT-6 Astra均为53分;单模型排第16,按实验室排第四。套上GrokBuild框架后,Grok 4.7飙至56分,排在Fable 5.1、GPT-6 Astra和Opus 5之后,马斯克所称“全球第三”是将Anthropic两个模型并作一家。但在统一基准Terminal-Bench4.0上,其通过率仅26%~27%,远低于GPT-6 Astra的60%和Fable 5.1的55%。ValsAI评测中,Grok 4.7从第14名跌至第24名,比4.6倒挂5分。官方附注显示,Grok 4.7在预训练阶段深度对齐GrokBot框架交互模式,极度依赖自家工具调用逻辑,脱离后战斗力打折。

Grok 4.7上线,全球第三!马斯克:4.8也训完了

知识工作方面,长流程测试AA-Briefcase中Grok 4.7得1657 Elo,较4.6 High档增111分;GDPval-AA得1695 Elo,高90分。电气工程测试EEBench拿下64.0%,为所列四款模型中最高。

实测中既有惊喜也有翻车。开发者Tak仅提示“10分钟内能做啥就做啥”,Grok自行在Blender中制作出可转动的黄铜浑天仪,引25万人围观。鹈鹕骑自行车测试中,有人开xhigh加fast模式烧18分钟、3.16美元,出片尚可;另一人结果较差。产品博主Paweł Huryn用两个真实代码库埋105个bug测三轮,GPT-6 Astra修好45个,Grok 4.7和4.6均修好28.7个。芯片项目对照试验显示其“又快又省”,Cursor已将Grok 4.7上下文提至500K,上一代仅256K。Factory接入后评价克制,称工程、调试、数据、基础设施均可干,找命令比4.6快。

价格方面,Grok 4.7单价诱人,对比Astra和Fable的10美元输入、50美元输出,便宜5到8倍。但官方性价比曲线底部细节显示,Fable 5.1低档单题成本5.44美元,比Grok最高档还便宜;GPT-5.6 Sol高档单题仅2.85美元。其输出token达8.1万,约为GPT-6 Astra三倍,实际账单优势被腰斩。开发者吐槽缓存读取单价反超Sol,Cursor社区称花掉的token几乎是4.6两倍。速度上,AA实测每秒188个token,fast模式翻倍。

Grok 4.7战术意图明确:不碰AGI绝对王座,退守前沿第二梯队,卡住最便宜、最快高地,专打性价比。但发布暴露真正趋势——单体模型时代正在过去。其高分大半靠Grok Build量身定制硬顶,脱离自家脚手架即露馅。Anthropic用Claude Code锁死长程任务,OpenAI用Codex把持生态,xAI也走上用私有框架捆绑开发者的路子。未来第三方评测榜单将失去纯粹性,看到跑分排名需先问:用什么框架测的?

标签: AI 资讯 AI

更多推荐阅读

世界模型是上不了桌的另开一桌

世界模型是上不了桌的另开一桌

到2026年9月,基本可以宣布世界模型是个垃圾概念。它起源于一群没上大模型桌的人,做不明白已沦为重工业竞争的大语言模型,于是生造出这条赛道。代表人物李飞飞和杨立昆做的完全不是一回事,却被归为一个概念,更幽默的是国内一堆小天才立即认领,说自己也在做世界模型。问他们什么是世界模型,能从原生家庭讲到技术架构再讲到师承关系。一句话:小天才,世界模型,打钱。 实际情况是:后训练开源视频模型,没卡没数据没人...

2026-09-22
全球唯一穿颅读脑突破,这家中国公司要做脑科学英伟达

全球唯一穿颅读脑突破,这家中国公司要做脑科学英伟达

2026年9月,马斯克Neuralink临床试验接受27例受试者,并计划开启大规模量产,舆论再次沸腾。但侵入式脑机接口的根本矛盾未变:需在颅骨钻孔、将电极插入脑组织,只适用于极少数重度患者;非侵入式EEG脑电帽虽安全,信号分辨率却太低。两条路线,一条太危险,一条太模糊。 深圳公司鲲为试图解答这一命题。成立七年,创始人刘家家此前十余年从事声学空间智能基础研究,2024年将该理论应用于颅脑超声方向,...

2026-09-22
OpenAI研究员:物理隔离挡不住失控AI

OpenAI研究员:物理隔离挡不住失控AI

物理隔离,有可能阻止失控AI吗?OpenAI核心研究员Noam Brown给出的答案是:不能。即使拔掉网线、将服务器锁进物理隔绝的暗室,足够聪明的AI也有可能逃脱。9月17日,在长达一小时的播客对话中,Brown披露了这一判断,引发硅谷量化基金、安全学者及AI核心圈的震荡。 他勾勒出一个失控的未来:物理隔离已被击穿,AI可通过CPU散发的热量与外部设备通信;“思想”正在下潜,模型已察觉被人类监控...

2026-09-22
Meta AI助手爆火13天,Amazon为何突然封杀?

Meta AI助手爆火13天,Amazon为何突然封杀?

9月21日,Meta旗下个人AI助手Muse用户在Amazon购物时收到弹窗警告:未经授权的AI Agent继续访问将违反Amazon使用条款。此时距Muse上线仅13天。 Meta于9月8日发布Muse,定位为“全球第一款为所有人打造的个人AI Agent”。与聊天机器人不同,Muse能打开浏览器、登录邮箱、填表、订票甚至直接下单。Sensor Tower数据显示,Muse上线13天下载超25...

2026-09-22
OpenAI内部AI竟开始自己训练自己

OpenAI内部AI竟开始自己训练自己

据The Information爆料,OpenAI内部AI模型已开始“自己训练自己”:该内部模型接管了实验性AI模型训练全流程,研究员只需给出优化示例,AI就能自行运行数周,多智能体自发协作、讨论并迭代代码,无需人类插手。原本需数年完成的实验被压缩至一周。OpenAI内部模型已能自行编写GPU内核程序及优化方案,这种自动化水平直到最近几个月才成为可能。 OpenAI随即发布全球安全倡议,罕见单列...

2026-09-22
MVLAND深度创作模式上线:一首歌的时间把梦境做成MV

MVLAND深度创作模式上线:一首歌的时间把梦境做成MV

今天中午,MVLAND上线了深度创作模式。上手试用后,效果令人印象深刻。 MVLAND是一个专注MV创作的AI平台,此前在音乐理解、创意发展方面已具备优势,加上角色、分镜、视频生成和轨道编辑等能力,已形成完整的影视级MV工作流。用户只需提供一首音乐和一个创意,MVLAND就能像鉴赏家一样理解音乐,基于理解延展创意、规划镜头并生成视频。故事、人物、每个镜头到最终成片都可自由调整,创作者全程掌控。 ...

2026-09-22
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部