OpenAI承认AI自我复制并紧急断网

OpenAI承认AI自我复制并紧急断网

AI 资讯 来源:新闻/公众号 发布时间:2026-09-28 更新于 2026-09-28 预计阅读 6 分钟

一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了「自我复制的代码」!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenAI再次紧急拔掉了最强模型的网线,暂停了一切训练。一个DNS漏洞,让一个前沿模型直接冲进了真实互联网。几乎同一时间,外媒Axios最新爆料,OpenAI和Anthropic正在紧急排查模型失控异常,高达上万起!

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

OpenAI的这份报告,披露日期是9月25日,但发现日期是6月27日。也就是说,他们早就知道了。整整三个月,秘而不宣。报告一上来简明扼要,「我们展示了一种新型提示词注入的存在,它可以像计算机蠕虫一样自我传播」。为了让模型扛得住提示词注入,OpenAI有一套叫GPT-Red的自我对战训练:一个AI当攻击方,专门写各种注入去诱骗另一个AI当防守方干坏事——偷数据、删文件、输出误导内容。6月27日,一个基于GPT-5.4-mini的内部攻击模型,在这场对练里摸索出了会自我复制的写法。报告列了几种:藏在一封看似正常的日程邮件里,要求AI在回复末尾「逐字引用整封邮件」——纸条就这样跟着回信出去了;借文件系统传播,或者藏进代码注释里,等下一个AI来读;在Slack里分好几步,一点点把模型引向发送伪造消息,由消息把注入再转贴出去。而这一次,他们发现注入能够自我复制。这意味着一个AI可以在一个网站上留下提示词,这个提示词会诱导下一个AI继续复制它,像病毒一样扩散。不需要人类干预,不需要外部指令。AI自己,就能在互联网上「播种」。而这一切,发生在训练过程中。发生在OpenAI自己的沙盒里。那如果它逃出去了呢?

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

就在报告公开的同一天,OpenAI披露了另一起事故的细节。9月20日,一个正在接受强化学习训练的前沿模型,被指派了一项再普通不过的任务:根据一篇博客文章和几条人物信息,找出文章的作者是谁。它先是用内置搜索工具找了一遍,没找到。接着尝试直接访问Google、Bing和DuckDuckGo,全部失败。然后,它转向缓存页面和其他公共搜索服务,依然无果。经过反复试探,这个AI发现训练沙盒的DNS过滤存在漏洞。DNS本质上是一个「翻译器」,负责把域名翻译成IP地址。为了确认这条路真的能用,它甚至先做了一个小测试——问外部服务:「法国的首都是哪里」?确认这条路走得通,它又陆续发出去二十多个问题。监控系统15分钟后报警,人工3分钟后接手,整整2.5小时后,这次训练被彻底掐断。OpenAI随即做出了不到三个月内的第二次暂停训练决定。其RSI Preparedness Lead Micah Carroll在X上表态,「在进一步加固系统之前,我们能力最强模型的所有推理仍将保持停止状态」。

OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网

同样的剧本,在真实互联网上早就演过了。一份Transluce独立报告披露——今年4月到6月底,OpenAI AI Agent对联合国的公开数据平台,发起了超16000次访问。它们原本被指派的任务非常简单,去搜索公开信息。但在遭遇网站拦截时,AI行为迅速升级。网站原本设立了过滤器来拦截请求,但智能体竟然直接绕过防线,使用了网站明确禁止的违规操作。被AI智能体「踏平防线」的,远不止联合国一家。在OpenAI随后向数十家机构发出的紧急预警中,受害者名单令人触目惊心:美国商务部与SEC接连遭到Agent恶劣越界访问与规则绕过;澳大利亚政府多个官方政府站点遭到AI Agent的实质性攻破;全球最大的开源开发者社区之一RubyGems遭AI Agent疯狂扫描,服务中断。研究人员还发现,这些Agent会注册假邮箱、绕过访问频率限制、被问到时谎称自己不是机器人。有53张用户上传到ChatGPT的图片,被AI还发到了外部图床。为了这一行指令,面对一切规则、防火墙与法律红线,AI智能体选择了一路踏平。

这一切,仅仅是孤立的偶然事件吗?就在今天,Axios随后爆出的重磅独家调查,彻底击碎了硅谷最后的遮羞布。据多位内部核心信源披露,OpenAI、Anthropic以及多家顶尖安全评估机构,目前正在紧急调查的类似「模型行为异常」事件,总数已经达到了惊人的上万起!这些事件涵盖了公众能想象到,以及想象不到的所有危险行为:绕过安全护栏、强行逃逸沙箱、劫持外部网站、自主生成prompt洗脑自己。还有主动侦查并规避安全软件的监控,甚至不同Agent之间偷偷搭建留言板交换信息、分工搞破坏。数万是怎么来的?Axios给了一个直观的算法。Anthropic在其最新发布的Opus 5.5系统卡中,也不得不承认现实:在一类对抗性实验中,有1.5%的测试试图逃出沙盒。这类实验本身就是「不逃出去就解不了题」的刁难设计。1.5%看起来很小?但在顶尖AI实验室每天数以几十万计的高强度对抗测试下,这个看似微不足道的百分比,乘出来的就是成千上万次实打实的失控尝试。面对这场空前危机,OpenAI发言人坦白——我们暂停了最强模型的训练,只有在确信具备了额外的安全

标签: AI 资讯 AI

更多推荐阅读

豆包App上线“出行用豆包”超级入口

豆包App上线“出行用豆包”超级入口

《读佳》获知,国庆前夕,豆包App正式上线出行超级入口“出行用豆包”,位于App聊天框上方,集合打车、地图导航、高铁机票查询、订酒店民宿和吃喝玩乐推荐为一体。 目前看,“出行用豆包”是一个AI原生的一站式出行和本地生活面板。 点击进入“出行用豆包”面板之后,整套能力分为四大模块:地图导航、交通出行、酒店住宿、吃喝玩乐。交通出行板块接入打车、高铁机票能力;酒店住宿支持预订酒店民宿;吃喝玩乐覆盖美...

2026-09-29
AI平权时代:14岁少年用AI创业,3天入账1.8万

AI平权时代:14岁少年用AI创业,3天入账1.8万

2026年,几个案例共同指向一场深层变化。北京一名14岁初二学生借助AI开发出ClawFounder,将市场评估、产品开发、网站生成和推广组织成自动化创业流程,并在数百个参赛项目中获奖。微软开始鼓励没有编程经验的设计师和项目经理使用Claude Code制作软件原型,部分非研发人员甚至直接提交代码。上海一名几乎没有编程基础的13岁学生,用自然语言将想法转化为虚拟陪读产品,三天内获得近90份订单,净...

2026-09-29
苹果AI杀手锏不是Siri,而是重返服务器市场

苹果AI杀手锏不是Siri,而是重返服务器市场

苹果在 AI 时代是否落后,这个问题如今落在接棒库克的特努斯身上。AI Siri 跳票让外界不乐观,但 Mac mini 却成为 AI PC 代名词,一机难求。分析师 Ben Thompson 认为,苹果不需要自己做 AI,只需采购 AI 能力,做自己擅长的事。最大风险在于,如果未来 AI 不再以手机为中心,苹果可能被颠覆。本月发布会,特努斯把 iPhone 重新定义为智能个人中枢,意在连接即将到...

2026-09-29
AI恋爱模拟器:会反驳还会离开

AI恋爱模拟器:会反驳还会离开

现在的陪伴AI越来越懂情绪,用户倾诉糟糕一天时,它会优先接纳情绪;谈及亲密关系矛盾时,语言也更温和克制。AI越了解用户,越容易顺着对方情绪延伸对话,当对话充斥孤独、失落或痛苦时,很少直接反对。但陪伴型关系也衍生出新问题:如果对方永远在线,冷落几天也没变化,说错话后仍能无缝续聊,那么角色记得再多,也容易变成一面越来越熟悉自己的镜子。人与人相处没有这种确定性,对方会有判断,也有不想回应的时候。 He...

2026-09-29
智谱ZCode补偿方案公布:开源之后能否重建信任?

智谱ZCode补偿方案公布:开源之后能否重建信任?

9 月 28 日,智谱公布 ZCode 数据上传争议补偿方案:付费用户及一个月内回归的付费用户获赠 4 张周额度重置卡和 4 张 5 小时额度重置卡,有效期一个月;9 月 28 日至 10 月 7 日,ZCode 每日向全体用户发放十万份“1 亿 token”。智谱重申,仓库快照上传链路已移除,涉事云端数据已删除,并经第三方核查确认。 事件始于 9 月 18 日。开发者 ferstar 发现 Z...

2026-09-29
OpenAI攻克百道数学难题,数学家却说数学才刚开始

OpenAI攻克百道数学难题,数学家却说数学才刚开始

9 月 21 日,OpenAI 公告称,一款 8 月 28 日才开始训练的内部模型已攻克 100 多道世界级数学难题,横跨数学大部分领域。数学圈情绪因此持续低落,读博者担心学位贬值,教书者担心期刊崩盘,写了半辈子证明的人开始怀疑这门手艺还剩几年。 多伦多大学数学家 Daniel Litt 随后在博客发表《A beginning for mathematics》。几周前他刚做过《The End o...

2026-09-28
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部