实测GPT-6:从零完成3D项目,AGI已来?
这个月我高强度使用了 GPT-6 Astra,让它操作软件、写东西、跑长任务,并接上 Hyper3D 测试一个我完全不会的 3D 项目,看它能否从模糊需求出发,自己找工具、做模型、拆部件、写网页并交付成品。测试后我强烈感觉:如果 AGI 是能理解目标、调用工具并独立完成工作的通用智能,GPT-6 可能已经踩进去了。

最初让我产生这种感觉的,是 Blender 艺术家 Viper 转发的一段演示。Duncan Trussell 用 GPT-6 Astra 直接操作 Blender,做出完整 Backrooms 场景,包括建模、灯光、VHS 质感和声音,大约 5 个 prompt、30 分钟制作、20 分钟导出。Viper 原本认为自己的 Blender 技能难以被替代,看到后却直接破防,称这像恶作剧。这个 Demo 的不同在于,Astra 不是教人怎么做,也不是生成伪 3D 图片,而是真的打开 Blender 开始干活。AI 不再只是坐在艺术家旁边回答问题,而是坐到了他的工位上。

类似案例还有很多。OpenAI 让 Astra 跑 2023 Microsoft Excel World Championship 任务,它直接进入 Excel 完成金融建模,速度约为当时人类冠军的 4 倍。音乐人 Auggie 只要求它用 LilyPond 完成巴赫风格作品,Astra 在 Extra High 模式下交出了完整可用的乐谱文件,能保持主题、声部和和声结构。用户 GoFly 把 FPV 无人机飞控板交给 Astra,它在 KiCad 里从原理图做到六层 PCB,完成摆放、布线、ERC 和 DRC 检查,并导出 Gerber、BOM、贴装坐标,全程三个多小时,后来板子通过嘉立创审核并成功下单。

Excel、音乐、PCB 看似无关,但 GPT-6 做的事相似:进入专业人士真正工作的环境,接走其中一段工作。于是我也想测试:如果任务碰到它不具备的专业能力,它会停下,还是找更专业的工具继续做?
我选了 3D,因为我基本不会。我只给它一句模糊需求:“帮我做一个可以拆开维修的火星探测车 3D 网页,3D 模型用 Hyper3D MCP 来做,最后给我一个真的能玩的成品。”接好 Hyper3D 后,我基本不管。GPT-6 先调用 Hyper3D Rodin 生成火星车,再拆成控制与通信舱、太阳能板、四个驱动轮等 7 个模块。中间只因下载授权停了一次,我点允许后它继续。
最后它把任务设计成“ARES 火星维修站”小游戏:背景是沙尘暴后,右侧列出恢复通信、清理太阳能板、紧固驱动轮三项任务,中间是可旋转检查的探测车。点击右前驱动轮会诊断出轮毂固定件松脱,要求拆下并进入维修台,用除尘刷、力矩扳手和校准仪处理不同问题,再装回并验收。我提供的只是一个模糊终点,GPT-6 自己拆成了完整产品:3D 资产、独立模块、故障系统、维修工具、重装和验收。专业 3D 部分它没有硬做,而是调用 Hyper3D Rodin。
这正是我想测的:GPT-6 不需要自己成为 3D 建模师,而要知道何时需要专业能力,并把 Hyper3D 这样的模型组织进任务里。AGI 的关键,也许不是解决数学猜想,而是把工作真正做完。
更多推荐阅读

平头哥真武V900发布:AI算力从单卡走向千卡互联
从真武 V900 到新一代磐久超节点服务器,平头哥八年来布局的 AI 芯片、CPU、scale up 互联、scale out 网络和存储芯片,开始被装进同一套算力系统。9 月 22 日 2026 杭州云栖大会上,平头哥被完整推到主论坛台前,副总裁高慧发表题为「Agentic 时代卓越算力基石」的演讲,发布从真武 V900 芯片到 ICN Switch 互联芯片、磐脉智能网卡、镇岳 SSD 主控、...
2026-09-23
陆川用AI五天复原明代大爆炸,阿里全模态模型兜底影视生产
不用搭景,不用等演员,导演陆川和团队用AI把一场400年前的明代灾难现场做了出来。宫廷、火药库,以及史料中烟云如黑灵芝的大爆炸,按传统影视工业做法往往需要数月时间和千万级投入,这次只用了5天。 人物的脸、皮肤、神态已相当逼真,爆炸的烟尘、碎片、火光也稳稳接住。过去光是一场爆炸戏就要耗费19天。陆川团队把史料文字翻译成现代视觉概念,前后做了约四轮提示词优化,再参考真实爆炸影像校准。阿里视频生成模型...
2026-09-23
OpenAI新模型24天攻克100+数学难题
数学界正被AI迅速逼近。OpenAI一篇重磅博文披露,一款8月28日才开始训练的内部新模型,已攻克100多道世界级数学难题,横跨数学大部分领域,其中包括困扰学界多年的“纳维–斯托克斯”千禧年难题。从开训到9月21日官宣仅24天,进化速度令OpenAI内部数学家都感到意外。 9月8日,OpenAI称该内部模型在88小时内攻克NS千禧年难题,给出NS方程存在性与光滑性问题的证明,并公开166页论文和...
2026-09-23
国产AI生图新高度:真假难辨,还能精修到商用
两张图都是AI生成的,来自商汤科技正式上线的SenseNova U1 Pro,目前可在商汤小浣熊平台使用,API已向企业客户开放。 实测在SenseNova Studio平台进行,模型支持2K起步、最高4K清晰度。第一轮测试将一张生活照重构为纸质风格,随后仅修改人物外套内的黑色圆领T恤为白色,要求严格限定在可见内搭区域。由于T恤、皮带、裤子均为黑色且有胸牌遮挡,边界易混淆,但U1 Pro精准拿捏...
2026-09-23
剪映发布全新AI创作能力:从专业剪辑到普通用户全面提效
剪映在2026 AI新创作发布会上发布全新AI能力,覆盖PC专业版与App端,分别聚焦“提效”与“省心”。 PC专业版推出剪映Hub,一站式AI创作平台,将AI创作与多轨道剪辑连接,让脚本、素材与创作上下文在同一项目中延续,减少跨工具切换的断点与重复操作。剪映助手Agent介入专业创作流程,承担素材整理、粗剪、包装等工作,可根据创作目标规划任务、串联模型工具并自动运行,用户也可自定义工作流,沉淀...
2026-09-23
AI操控游戏新选择:Jev模型到底能做什么?
Jev 是 TypeSafe AI 推出的决策模型,创始人 Diogo Almeida 曾在 OpenAI 参与指令跟随与对话研究。TypeSafe 开发两年后发布该系统,官方称为 System One Models。其使用方式是把当前情况和问题输入,模型返回程序可直接使用的结果,本质上是分类模型,接口主要有三种类型。 在游戏场景中,可每一步询问它:当前血量、怪物和金币位置、出口位置,目标是拿金...
2026-09-23