复刻《我的世界》不到5分钟,Kimi新模型成本不足GPT-5.5三分之一

Kimi 发布了 Coding 专项模型 K2.7 Code,该版本基于 K2.6 架构继续训练。官方称,其 reasoning-token 使用量较 K2.6 降低 30%,响应更快、成本更低;在基准测试的部分特定任务上,表现已接近 GPT-5.5 和 Opus 4.8,实际成本不到 GPT-5.5 的三分之一。官方还预告,即将推出 6 倍高速模式。
更省更快的代码模型
作为专攻编程的版本,K2.7 Code 的核心卖点就是“省”。reasoning-token 减少 30%,意味着模型在生成回答前的“思考”过程消耗更少,开发者拿到的响应更快,账单也更友好。这样的成本优势在对比中更加直观:和 GPT-5.5 相比,它在部分任务上表现接近,但价格不到 GPT-5.5 的三分之一。对需要大量调用模型编写、调试代码的团队来说,这种性价比可能比单纯的分数提升更有吸引力。
实测:从动画到《我的世界》
在实际创作类任务中,K2.7 Code 有亮眼之处,也有明显短板。静态 SVG 生成熊猫,细节完整,但胳膊没有连接身体,结构理解仍有偏差;龟兔赛跑动画在修复后展现了惊喜:模型把兔子拆成起跑领先、睡觉、冲刺三个阶段,乌龟则匀速前进并最终反超。这已经超出了“画一张图”的范畴,体现了过程级行为建模能力。
复杂前端特效“火山喷发”也由纯 Canvas 实现,岩浆、粒子、灰云一个不少,还支持点击升级与冷却恢复;只是岩浆柱和熔岩流的视觉偏弱。Three.js 方向的测试中,模型能快速搭出魔法森林小屋的完整场景,但镜头、比例、材质都需要人工精调。复刻《我的世界》是另一个高光:用时不到五分钟,地形生成、第一人称控制、方块交互全部完成。苹果风格登录页整体接近,但首屏设备图只是渐变卡片,风格克制不足。
安全审计:识破漏洞,但未抓住关键点
在安全审计测试里,K2.7 Code 能识别 Zip Slip 漏洞,并给出 filepath.Rel、Clean 等修复方案及上线流程,说明它对常见漏洞足够敏感。但问题同样明显:它没有建立统一的路径规范化基准,也没有抓住 Windows 反斜杠跨平台路径语义这一关键问题。也就是说,修复建议可能无法覆盖所有运行环境,在真实工程中仍然需要人工把关。
总体来看,K2.7 Code 用更低的推理成本和更快的响应,在不少 Coding 任务中给出了接近顶级模型的体验;它在过程级建模和复杂场景生成上的表现,令人对后续版本更有期待。但安全审计与视觉细节上的缺失也提醒着我们,AI 生成代码要真正落地,还需要和人类工程师的经验形成互补。随着 6 倍高速模式即将上线,K2.7 Code 还能把“快”和“省”推到什么程度,值得持续观察。
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05