
22分钟从照片到可漫游三维场景,GPT-6实测惊艳
实测GPT-6:上传白宫照片,22分钟生成可自由浏览的三维场景,支持WASD漫游与日光调节;还能制作动画、游戏和文章,展现强大的自主完成能力。
精选 AI 新闻、神器与模型,一站式掌握人工智能前沿动态。
聚合 OpenAI、Anthropic、Google 等一手信源的最新动态

实测GPT-6:上传白宫照片,22分钟生成可自由浏览的三维场景,支持WASD漫游与日光调节;还能制作动画、游戏和文章,展现强大的自主完成能力。

OpenClaw 2.0正式发布,933位贡献者提交近1.7万个PR。实测对比显示,新版本从工具型Agent转向协作系统,强化长任务处理与团队协作,但工程门槛仍存。

苹果Mac mini涨价2500元后,作者用豆包工作应用进行设备选购比价,体验其多智能体并行和操作电脑功能,发现其能高效完成复杂任务,虽速度较慢但能提升效率。
Anthropic前脚刚发布了Fable 5.1(具体可见Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线),后脚第三方权威跑分和个人第一手实测已经出炉了! Anthropic研究员就展示了用Fable 5.1写代码,直接生成设计视频: 看看这效果,谁不想急头白脸地用一顿…… 话不多说了,咱们先上实测。 网友上手花样实测 看实例之前,先来看ARC Priz...

字节跳动整合飞书、TRAE Work等资源推出“豆包工作”,实测将10个AI产品创意转化为完整原型网站,并完成GitHub深度搜索,展示AI办公新可能。

阿里发布开源Qwen 3.8 Flash-Next,价格最低仅为DeepSeek-V4-Flash的1/3,125B MoE架构激活6B参数,原生支持262K上下文,实测文案改写与会议整理表现出色,被视为Qwen 4架构预演。

Google IO 大会发布 Gemini 3.5 Flash,官方称输出速度比其他前沿模型快四倍。实测显示其工具调用和多模态领先,但复杂推理与长上下文仍不及 GPT 5.5。本文梳理测试细节与成本分析。

Claude Opus 4.7全渠道上线,价格未变但tokenizer改动或使成本上升。视觉能力大幅提升,渗透测试正确率升至98.5%。作者实测20分钟做出招聘网站,同时吐槽文字风格“不说人话”。

阿里ATH事业群发布世界模型Happy Oyster,支持提示词与参考图生成视频及可交互3D环境,漫游和导演两种模式,实测漫游超一分钟不崩,官网已开放waitlist。

Kimi发布K2.6并同步升级Agent。实测中,无素材无方案也能一句话生成可玩坦克大战并搭好4人联机,还能复刻网站、生成打榜站;官方称复杂Agent任务成绩提升约20%,0经验做产品门槛被拉低。

OpenRouter匿名模型Elephant Alpha揭晓真身,实为百灵104B高速模型Ling 2.6 Flash。它响应秒级、成本仅GPT-5.4-mini的十分之一,正成为批量任务的新选择。

AI工具Ribbi内测体验:开箱即用,串联选题、视觉、文案、视频等子任务,减少多工具切换。设计师兼自媒体人阿真实测,认为其适合有持续内容生产需求的创作者,并会越用越懂你。

OpenAI发布GPT-Image-2,实测显示其在文字渲染、自主规划、跨图一致性上实现突破,并在Arena榜单以241分优势创下最大领先差距。这场反攻标志着AI生图从提示词工程转向模型自主思考。

阿里通义千问开源270亿参数多模态模型Qwen3.6-27B,以1/15参数规模反超上代,实测四分钟生成跑酷游戏,验证码识别超九成,主打部署灵活与可控。

OpenAI与DeepSeek同日发布新一代模型,首轮实测显示:GPT-5.5在编程、推理、长任务上全面占优,DeepSeek-V4则在可视化等场景更胜一筹。GPT-5.5虽然单价更高,但综合运行成本反而更低,还能自主运行31小时;安全…

小米MiMo-V2.5系列四大模型正式开源、权重全量开放。官方演示中,Pro版Agent无中断肝出类macOS桌面系统,54个原生应用与真实浏览器冲浪同台亮相,主打长程任务与模糊指令遵循,4个月跻身开源第一梯队。

商汤开源多模态模型SenseNova U1,实现行业首创连续图文生成,信息图能力达开源SOTA,支持本地部署与Agent调用,实测覆盖绘本、信息图等场景。

AI做PPT长期在风格与可编辑性之间顾此失彼,千问新出的PPT Agent在本周一场8小时直播实测中给出不同解法。本文梳理文生图、HTML两条旧路线的局限,并解析千问如何让“好看”与“能改”不再对立。

Bubble利用假期首日,将MiniMax、DeepSeek、Kimi、小米MiMo四款国产大模型接入OpenCode,以论文转PPT为任务展开横测,寻找最能干活的AI牛马。

作者复制4个相同Agent,只换模型,对GPT-5.5、DeepSeek V4 Pro、小米Mimo-V2.5-Pro和MiniMax M2.7进行千元级横测。文章详述测试背景、方法、候选模型亮点与成本考量,探讨谁才是Agent最佳搭档。
精选提升效率的 AI 工具,按场景分类快速找到合适工具
追踪国内外主流大模型与垂直领域模型最新进展
扫码关注公众号「60秒看懂AI」
微信搜索「60秒看懂AI」也可关注