1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

1300张卡击败GPT-6!前OpenAI副总裁造出材料大模型

AI 资讯 来源:新闻/公众号 发布时间:2026-09-18 更新于 2026-09-18 预计阅读 4 分钟

前OpenAI研究副总裁Liam Fedus在X上发布Periodic Labs首个模型Periodic Neon:仅用1300张H200,加上数月实验数据,在自研XRD分析基准上超过GPT-6 Astra。Neon约1T参数,在134道高难度X射线衍射分析题组成的FrontierXRD上成功率达55.3%,领先GPT-6 Astra和Claude Fable 5.1。Astra据传总参数数万亿、背后算力超10万张Grace Blackwell;Neon最终训练峰值仅1300张H200。Jeff Dean第一时间留言祝贺。

1300张卡叫板10万卡!前OpenAI副总裁出手,硬核难题击败GPT-6 Astra

Fedus曾是ChatGPT核心创造者之一,负责后训练。他去年创立Periodic时指出,互联网约10T token已被前沿模型读完,AI继续前进需要互联网没有的新数据,因此拉上前谷歌DeepMind化学与物理研究负责人Ekin Dogus Cubuk,自建实验室、自造数据,目标造一个AI科学家。

1300张卡叫板10万卡!前OpenAI副总裁出手,硬核难题击败GPT-6 Astra

XRD如同晶体指纹,但实验室样品常极不纯净,多种物质重叠,专家分析费时。Periodic另备198道训练数据中刻意剔除相关化学体系的题,Neon仍领先。成本上,Neon最高档每题约4美元多,Astra约7美元多且成绩更低,Claude Fable 5.1成功率约40%。所有模型均用Periodic自搭科学工具环境Periodic Harness,其成功率是Claude Code配标准XRD工具方案的3.8倍。

1300张卡叫板10万卡!前OpenAI副总裁出手,硬核难题击败GPT-6 Astra

Periodic在门洛帕克建高通量材料实验室,24小时运转,将材料发现拆成“做什么、怎么做、做了什么”循环,每轮产出新鲜私有数据。中训练语料混合文献、代码和实验数据,规模每月翻倍。其研究博客题为“自然就是学习环境”,瞄准互联网数据将耗尽后,谁能持续产出新数据谁就多一条Scaling路径。

物理世界RL面临智能体难扩展、实验耗时长、结果模糊三大障碍。Periodic请材料专家给数千XRD图谱打标签,校准由Opus 5和GPT-5.6 Sol组成的LLM裁判组:专家间一致率77.2%,裁判与单个专家74.6%,与专家共识84%,已逼近人类专家水平。

1300张H200是Neon中训练和RL同时跑的峰值卡数。科学任务RL中,做题耗时一个多小时,更新模型仅几分钟。Periodic让做题与学习分开用不同GPU。早期RL循环无隔离,模型代码申请80GB内存导致任务崩溃,遂自研沙箱pbox,调用RL节点闲置CPU跑科学工具,数据不出集群,比托管沙箱快4.5倍,吞吐量3.3倍,集群利用率常年超95%。

Neon已部署进实验室分析真实实验,寻找更好超导体和磁体。目前仅证明“看懂实验室做出了什么”,决定做什么和怎么合成尚在扩展。Fedus措辞克制:模型是“帮我们决定”,非替科学家拍板。官方称扩算力至前沿量级可解锁更强科学能力,未来可换更强开放权重底座。Fedus曾在GPT-4技术报告担任“数据飞轮”负责人,如今把飞轮从互联网文字搬进物理实验室。下一阶段Scaling,比的或许不只是谁能买十万张芯片,还要看谁的实验室能一刻不停往模型里送真实世界数据。

标签: AI 资讯 AI

更多推荐阅读

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

谷歌DeepMind成立AGI研究所,诺奖得主挂帅

几周前,GPT-6 Astra横空出世,OpenAI首次官宣AGI实现。今天,谷歌DeepMind火速成立全新机构——DeepMind研究院(DMI),由Demis Hassabis、Shane Legg与James Manyika联手挂帅。以前的DeepMind只想搞出AGI,现在问题升级为:AGI真的来了以后,全人类到底拿什么接招? DMI专门研究“超级智能”对经济和社会的颠覆性影响,目标是...

2026-09-18
OpenAI前核心成员造出只会做选择题的大模型

OpenAI前核心成员造出只会做选择题的大模型

TypeSafe AI创始人Diogo Almeida曾是OpenAI核心成员,参与创造RLHF和InstructGPT,2024年初离职创业,两年后推出全新模型Jev。该模型只做一件事:高频决策。它无法聊天、写代码或生成文字,是纯粹的通用分类器。 开发者Marcel Pociot用Jev做了浏览器插件,过滤X上不想看的内容,如引战、加密货币、政治争论等。每条帖子Jev在后台判断是否命中分类,平...

2026-09-18
中国电信通用Agent杀入IDC实测前三

中国电信通用Agent杀入IDC实测前三

IDC发布国内首份《中国企业级通用Agent产品技术评估》,中国电信TeleAgent进入前三。此次评估未采用大模型Benchmark,而是用近百道非公开任务考察Agent在真实办公环境中的端到端执行能力。TeleAgent常规任务得分3.49分、复杂任务3.36分,九项能力中任务表现获满分,成本效率为评测最高分。该产品今年4月内部试用,7月推出V1.0,一个多月用户规模已接近120万。 IDC...

2026-09-18
国产AI存储刷新全球纪录,焱融全栈布局曝光

国产AI存储刷新全球纪录,焱融全栈布局曝光

智东西9月17日报道,9月1日,MLCommons发布MLPerf Storage v3.0基准测试榜单。焱融全闪AI存储F9000X在多项测试中拿下第一,验证其在极限AI训练负载下对高速网络带宽的高效利用能力。 随着AI从模型训练走向规模化推理,存储需处理的数据和任务持续增加。训练阶段要持续向GPU供给海量数据,并快速保存和恢复模型Checkpoint;推理阶段需管理不断膨胀的KV Cache...

2026-09-18
AI短片斩获威尼斯双奖,千万级创作大赛开启

AI短片斩获威尼斯双奖,千万级创作大赛开启

十天前,AI超创DiDi_OK的《网站》在2026年威尼斯Reply AI Film Festival上斩获评审大奖与观众选择奖双料大奖。该片从76个国家3100多部作品中脱颖而出,评委包括奥斯卡得主和《狮子王》联合导演。影片用十来分钟探讨“观看能否改变现实”,凭借画面与叙事功力成为本届唯一同时获得两项大奖的作品。这类会讲故事的AI创作者,正是当下AI行业最稀缺的人才。 今天,虎鲸文娱集团正式启...

2026-09-18
奥特曼曝后Astra模型已超越全球顶尖数学家

奥特曼曝后Astra模型已超越全球顶尖数学家

在和Salesforce CEO Marc Benioff的对谈中,奥特曼剧透了OpenAI内部模型的最新进展。他判断:“GPT-5.5的水平大概相当于一个普通的数学教授。GPT-5.6,大概能比肩全球排名前1%到2%的顶尖数学教授。”随后他曝出重磅消息:“在这个代号为Astra的模型之后,我们还有一个内部模型(Post-Astra)。它已经能够解决世界上最顶尖数学家都束手无策的难题。”OpenA...

2026-09-18
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部