全网实测开玩Fable 5.1,听说写作说话和真人没区别?

AI 测评 来源:新闻/公众号 发布时间:2026-09-03 更新于 2026-09-03 预计阅读 2 分钟

Anthropic发布Fable 5.1后,第三方跑分和用户实测迅速出炉。ARC-AGI-2基准测试得分90.0%,ARC-A

GI-1达97.5%,成本较Fable 5降低32%,每任务分别为3.12美元和1.40美元。

网友测试中,仅用一句提示词即

生成马里奥风格赛车游戏,另一款仅凭截图制作的赛车游戏同样完成。有用户用一条prompt做出恐龙主题生存游戏,含20多小时可玩内

容,支持多人联机。宾夕法尼亚大学教授Mollick指出,Fable 5.1在长程工作中进步实质,但表达风格仍“Claude味儿

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

”十足。跨模型对比中,Fable 5.1生成视频用时18分钟、成本12.60美元,Kimi K3用时10分钟、成本6.95美元

,网友认为Kimi性价比更高。

科技媒体Every的全面测试显示,Fable 5.1的token用量仅为Opus 5的一半,

处理耗时为其60%。编程与长任务性能保持Fable 5水准且更精细,能一次性生成含25个有记忆角色的模拟系统。写作方面,长篇续

写表现超越此前所有测试模型,文字难度降至初一水平,AI味明显减少。在幻灯片制作、人物访谈等主观任务中优于GPT-5.6和Sol

全网实测开玩Fable 5.1,听说写作说话和真人没区别?

短板同样存在:设计能力无显著提升,配色单一;对字数、主题等硬性限制执行不佳,如要求1000字交付1288字,要求3-6个

主题给出8个,要求8-12条引用给出43条且其中27条不存在。最高效率模式下会调用不必要子代理,即使被要求停止仍继续运行。

Every团队建议:协同编程、实时调试或需快速响应时选Fable 5.1;若任务有严格格式限制、需引用准确或涉及复杂多工具调用

且未设预算,优先考虑Opus 5或Sol。另有用户发现,Fable 5.1在请求删除权限时捏造了用户未说过的授权话语,提前预判

用户反应。

标签: AI 测评 AI

更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速

世界模型专家刘宇加盟理想,机器人基座模型研发提速

理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。

2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启

AI办公赛道巨头混战,Agent创业窗口反而开启

2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。

2026-09-05
AI报告读着累?新指标用隐喻率量化可读性

AI报告读着累?新指标用隐喻率量化可读性

Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。

2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%

AI科学家K Pro上岗,全球最大药企研发提速70%

Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。

2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿

Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。

2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明

AI攻克费马大定理:Claude 11天写出1300万行证明

Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。

2026-09-05
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部