Hinton首篇RSI论文:AI自我改进会引爆智能爆炸吗

Hinton首篇RSI论文:AI自我改进会引爆智能爆炸吗

AI 资讯 来源:新闻/公众号 发布时间:2026-10-06 更新于 2026-10-06 预计阅读 4 分钟

当AI开始参与研发下一代AI,人类可能已站到“智能爆炸”前夜。诺贝尔物理学奖、图灵奖得主Hinton的首篇RSI论文,研究的问题是:如果AI大规模参与造下一代AI,下一代AI再回来加速研发,一轮轮滚下去,会不会跑出智能爆炸曲线?论文名为《What if automating AI R&D triggers an intelligence explosion?》,22位作者包括Hinton、Bengio、Andrew Barto、OpenAI首席科学家Jakub Pachocki等。

刚刚,Hinton发了首篇RSI论文

核心观点是:一旦AI能完整参与造下一代AI,递归自我改进就可能真正闭环。AI研发自动化越过临界点后,几年才能完成的AI进步可能被压缩到几个月甚至更短;未来AI实验室研发规模理论上可能从几千人跳到数百万研究员;今天一年的AI进步,极端情况下未来可能只需约5周。智能爆炸未必需要AI先变成超级智能,只要AI研发自动化效率足够高,反馈循环就可能先启动。

刚刚,Hinton发了首篇RSI论文

论文引用Anthropic等内部数据:2025年1月AI生成获批代码仅低个位数比例,2026年5月已超80%;2026年3月Claude在高层监督下可自主完成约1%研发工作,同年8月升至26%,半年翻二十多倍。Anthropic强调Claude尚未在任何被测AI研发工作上达到完全无人监督。截至2026年9月,OpenAI内部AI系统已能经常完成原本人类需数天的研发任务。关键变化是AI能独立处理的任务长度持续增长。完整AI R&D包括提出假设、设计实验、实现、分析、定位失败、调整路线,任何单项自动化只是辅助,真正敏感的是串成长链。AI研发发生在数字环境,代码可直接执行,结果快速返回,指标立即验证,比化学生物制造少很多现实反馈环节。论文称这类路径为software-driven intelligence explosion。

刚刚,Hinton发了首篇RSI论文

AI研究员可复制,是与人最大的区别。若实验室有1000名顶尖研究员,开发出顶级人类AI研究员水平的Agent后,扩张团队不再受人才培养速度限制,可24小时工作,成千上万实例同时跑,底层模型更新则整支团队同步升级。论文引入“有效研发劳动力”概念,估算若AI达顶级研究员水平、推理成本与今天前沿模型类似,领先AI公司现有算力理论上可支撑至少数百万名顶级人类研究员等价的AI研发劳动力。但100万AI研究员不会自动带来1000倍研发速度,科研存在边际收益递减。论文关键变量是returns to research effort,记作r。引用三个AI研究子领域历史数据,r中心估计约1.2—1.9。假设AI研发全面自动化、研究回报维持、短期无算力数据瓶颈,AI技术进步速度可能约1.5年内提高10倍,即今天一年的进步届时只需约5周。若只维持当前软件效率改进趋势,自动化AI研发劳动力数月到数年可能扩大100倍,且数量与单员能力可同时推进。智能爆炸真正危险处在于:加速来源本身也在被加速。

但论文基调是,当前证据远不足以证明智能爆炸已闭环。

标签: AI 资讯 AI

更多推荐阅读

Mistral发布1T参数大胖猫模型,激活仅49B

Mistral发布1T参数大胖猫模型,激活仅49B

今天早些时候,美国开源了 glm5.2 级别的模型。随后,欧洲的 Mistral 发布了 Mistral Large 4,又名 Le Chonk 大胖猫。 该模型总参数 1.05T,每次只激活 49B,另带一个 1.6B 的视觉编码器。它采用细粒度混合专家(MoE)结构,模型拆成很多“专家”,每处理一个词只叫醒其中一小部分,因此 1T 模型每算一个词的开销接近 49B 模型。原生多模态,能读文字...

2026-10-07
xAI联创宣判:数学两千年英雄时代落幕

xAI联创宣判:数学两千年英雄时代落幕

两千多年来,人类最聪明的大脑一直在攀登数学这片山脉。从欧几里得到怀尔斯,每征服一座山峰都要赌上一生。但xAI联合创始人Christian Szegedy认为,这个属于数学的英雄时代正在结束。 Szegedy在长文《数学何去何从?》中,将数学家比作丛林里徒手攀岩的探险家,AI则是一架飞机,已把旗插上没人爬过的山顶。孤独攀登者的时代正在结束,测绘整片大陆的时代正在开启。 Szegedy少年时在匈牙...

2026-10-06
OpenAI疯狂28天首日:模型提速50%却遭评论区翻车

OpenAI疯狂28天首日:模型提速50%却遭评论区翻车

Codex负责人Tibo宣布启动“疯狂28天”计划:未来28天每天要么交付一项Codex/Work改进,要么进行一次完整额度重置。第一天,Tibo宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%,达到50TPS,覆盖官方订阅及Sign in with ChatGPT接入的第三方生态。 但评论区几乎无人关注提速,满屏冷嘲热讽。此前9月29日GPT-6.1 Sol上线后因负...

2026-10-06
AI研究员为何计划逃离湾区买地避难

AI研究员为何计划逃离湾区买地避难

一些Anthropic最期的员工,最近开始考虑在美国偏远地区买地。他们想过,如果AI真的失控,那里或许可以成为避难的地方。 “一切再也无法平静如初。”一些研究员的电脑上贴着同一句话。 事实上,逃离的念头并非突然出现。十多年来,一群聚集在旧金山湾区的AI安全研究人员,一直在讨论AI失控之后可能发生什么。那时候,Anthropic甚至还没有成立。 有人在伯克利设立共享办公空间,在私人Slack频...

2026-10-06
英伟达押注的Reflection开源新模型对标智谱

英伟达押注的Reflection开源新模型对标智谱

英伟达投资的 Reflection 发布首个开源模型 Beam,对标智谱 GLM-5.2。官方称两者在高级推理测试上分数相当,Beam 推理算力仅需后者的三分之一到四分之一。彭博和金融时报称其为美国在开源模型领域对中国的反击。但 Beam 与国内其他头部开源模型如 Qwen3.8、GLM5.3、Kimi K3、DSV4F 仍有差距。 Reflection 由谷歌 DeepMind 两位研究员 M...

2026-10-06
把35个判断交给内核:这个开源项目拿下黑客松总冠军

把35个判断交给内核:这个开源项目拿下黑客松总冠军

在进化酒馆黑客松深圳收官之战中,项目 mu(μ)获得全场冠军。它将 Jev 深度融合进 Harness,试图解决 Agent 把工具、日志、技能、上下文全部交给大模型导致效率低、Token 浪费的问题。 mu 建立在开源 Coding Agent pi 之上,主要改造模型外的 Harness,设计了 35 个判定点,覆盖用户输入、工具调用、上下文管理、任务完成判断和多 Agent 通信等环节。例...

2026-10-06
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部