全能博士级AI上线:GPT-6 Astra凌晨发布,电脑操作与推理双双突破
北京时间凌晨3点33分,OpenAI正式发布GPT-6 Astra,并称其为“全球最智能且最对齐的模型”。这款模型并非纯代码特化,而是定位为全能型博士级员工,初期仅向部分组织开放,订阅用户需等待数日。

技术规格与定价

API编号为gpt-6-astra,上下文窗口达105万Token,最大输出128K Token,知识截止2026年4月30日。推理强度分五档,API定价为每百万输入10美元、输出50美元,与Claude Fable 5持平。据称,这是OpenAI最大规模的训练,使用了超10万张卡,参数约5T级。

核心能力:电脑操作与推理突破

GPT-6 Astra在电脑操作方面表现突出,被定位为全球最佳电脑操作模型。它可直接模拟人类操作屏幕,完成Excel处理、前端QA、软件安装排障、电路板设计等任务。在OSWorld评测中,完成率达72.6%(前代65.7%),复杂任务耗时减少47%;ScreenSpot-Pro得分92.7%(前代76.9%),界面定位精准度极高。

推理能力同样惊人。在ARC-AGI-3基准测试中,GPT-6 Astra得分99.9%,远超人类平均48%及前代模型(GPT-5.6 Sol为7.8%,Claude Opus 5为30.2%)。该测试要求模型在无说明环境中自主探索规则并迁移应用,OpenAI联合创始人Greg Brockman据此宣称“已进入AGI时代”。
审美与主动判断
模型还具备“视觉判断力”,可优化PPT版式、文档视觉风格,能根据参考文档改编内容,并支持Blender建模、UE5渲染等3D设计工作流。此外,新增的“Judgment”能力让模型能自主处理日常可推断的缺失信息,仅在关键决策时提出聚焦问题。在Codex中,它可边提问边推进不依赖回答的部分,低风险任务采用合理假设,关键节点等待用户决策。
安全对齐与展望
针对Agent权限扩大带来的风险,OpenAI同步强化了安全机制,确保模型在具备浏览器、Shell等操作权限时的行为可控。从电脑操作到推理突破,再到审美与主动判断,GPT-6 Astra展现了向全能型AI迈进的姿态。尽管初期仅向部分组织开放,但其技术指标已为行业树立新标杆。随着订阅用户逐步接入,这款“博士级员工”将如何改变人机协作的日常,值得持续关注。
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05