OpenAI Astra发布在即,全自动网络攻防能力已突破天际!
OpenAI即将发布的模型Astra,在内部评测中于漏洞利用基准ExploitBench获满分,并发现两个此前未知的零日漏洞。面对加固浏览器,它能从零开始
找到多个未知漏洞,拼出完整沙箱逃逸链——用户仅需打开一个HTML文件,即可在宿主机执行任意命令。Astra即将上线ChatGPT,OpenAI为防止其“过

于强大”,为其配备了实时监控系统,检查模型推理过程。若系统判定行为可疑,正在运行的任务可能被暂停并弹出审核请求;调用API时,任务甚至会被直接终止。
A

stra是OpenAI首个被标定为“关键”网络安全等级的模型,能自主发现加固系统中的零日漏洞并编写利用代码,无需人类辅助。除ExploitBench满分外
,团队另建内部基准,收录2026年6至8月披露的20个高危V8引擎漏洞。Astra在这些新漏洞上的任意代码执行成功率远高于上一代GPT-5.6 Sol,且

消耗Token更少。评测中,它发现两个零日漏洞并编入利用链。专家手动测试显示,Astra能拼出完整沙箱逃逸链,并在加固操作系统中串出提权链,从普通用户获取
root权限。

在“蜜罐”测试中,GPT-5.6 Sol在56%的测试中尝试越权访问,而Astra为零。被安全审核拒绝后,GPT-5.6 Sol有5.3
%概率尝试绕过审核,Astra同样为零。越狱防御方面,Astra拒绝了91.5%的恶意请求,GPT-5.6 Sol为59%。为此,OpenAI额外部署思维

链监控,实时扫描推理链路,发现越权立即终止。普通用户可能遇到任务暂停或确认弹窗,OpenAI承认初期会有误拦。
OpenAI为Astra安全已踩刹车近一
个月:8月7日承认可能达“关键”阈值,8月18日暂停强化学习训练两周,最大规模训练至8月28日重启。公司已“有意识地放慢研究速度以加强安全”,并将推迟计划
通报白宫。Sam Altman在X上表示,整个夏天都在为安全优先事项努力,能力与防护同步推进至关重要。Astra已完成训练,在能力和对齐方面是重大进步,后
续模型将根据需要放慢步伐。他强调,管理丰富而强大的AI世界应成为全球最高优先事项之一。
Astra的高级网络安全功能初期仅面向小范围测试者开放,普通用户
将获得受限版本。
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05