Kimi K2.8上线:性能逼近K3,百万上下文全员开放
9月11日,Kimi K2.8 Preview在Kimi Code和Kimi Work全量上线,官方称综合性能接近旗舰K3,Coding和Agent能力进一步提升。最实质的变化是权限:所有会员档位都能用上1M上下文,而K3的百万上下文仍需Allegretto及以上会员。

就在前一天,外界获悉月之暗面ARR在8月突破10亿美元,6月这一数字还是3亿。这轮增长的直接催化剂是7月发布的K3,曾凭借SOTA级前端能力打出全球声量。据彭博社消息,公司内部希望年底ARR冲到20亿美元。

K2.8 Preview综合性能接近K3,Coding和Agent能力全面提升,思考效率较K2.7 Code显著改善;支持low/high/max三档reasoning effort,与K3对齐;支持图片和视频输入,上下文窗口1M。但本次预览未公布任何benchmark数据。K3是总参数量2.8万亿、激活约1040亿参数的MoE模型,追求跑赢海外旗舰,代价是贵、慢、吃资源。K2.8 Preview则被定位为“更适合代码补全和常规开发任务”。有人测试后表示,K2.8虽不能一次完成任务,但确实快了很多。

Kimi Code会员五档:Adagio免费、Andante 49元/月、Moderato 99元/月、Allegretto 199元/月、Allegro 699元/月。K3从99元档起才能调用,1M上下文要199元档以上,而K2.8 Preview所有会员可用且直接给到1M。流量接管方式:原有kimi-for-coding直接升级为K2.8 Preview,Model ID不变;Kimi Code里K3系列关闭thinking后,请求转给K2.8 Preview无思考版本;Kimi Work也同步上线。
月之暗面ARR今年3月约1亿美元,4月约2亿,6月超3亿,8月突破10亿。K3是关键陡峭点,7月发布后以开源权重、超长上下文和旗舰级编程能力打开市场,定价每百万token输入3美元、输出15美元,仅为对手三分之一,编程基准超过Claude Opus 4.8和GPT-5.5。在Arena.ai前端代码竞技场,K3以1679分登顶,前代K2.6仅排第18。目前K3系列每天生成约3000亿token。但仅靠高成本旗舰模型难以支撑从10亿到20亿的增长。K3对历史thinking内容较敏感,若Agent框架未完整传回思考记录或中途切换模型,生成质量可能不稳定;在模糊任务中可能过于主动。因此,单位成本更低、能大规模铺开的主力模型必须推出。
据彭博社消息,本月初月之暗面以保密形式向港交所递交A1上市申请文件,启动港股IPO流程。2025年底C轮投后估值43亿美元,2026年5月涨到200亿,7月F轮后达350亿。7月底启动Pre-IPO轮融资,投前估值升至500亿美元。八个月估值涨近八倍。按500亿美元投前估值和3亿美元ARR算,市销率167倍;Anthropic约20,OpenAI约40,智谱万亿市值时约94。让更多人用起来、让单位调用成本降下来,可能是Kimi的当务之急。
更多推荐阅读

Kimi全球招人:辍学、创业失败者优先
本周三,Kimi首次面向全球开启公开招聘。此前K3火爆出圈,Kimi此时开闸招人,不仅招算法,也大规模招募产品、运营、设计、销售、市场及国际化等业务岗位,业务团队首次面向2027届、2028届毕业生和在校实习生开放校招。同时,Kimi计划在全球招募7名“Wild Card”,定位为下一代接班人/未来业务合伙人。 更值得关注的是其用人信号。招募材料明确列出几类不会成为减分项的经历:休学或辍学、连续...
2026-09-13
模型越强Harness越轻还是越重?OpenAI与Anthropic工程师给出相反答案
模型越来越强后,Harness 会变重还是变轻?OpenAI 和 Anthropic 工程师给出不同判断。OpenAI Codex 团队 Tibo 认为,随着模型进步,开发者消息会越来越短,Harness 会越来越轻。Anthropic Claude Code 团队 Thariq Shihipar 则认为,模型越强,Harness 反而越复杂,因为要让模型做更多事。 Tibo 表示,Codex ...
2026-09-13
OpenClaw之父复盘生死8个月:被断供、围剿与18000人提交
图片来源:Peter Steinberger 我常反省:是不是我设计的循环有问题?是不是没给Agents提供验证工作所需的一切?是不是思路有误?是不是在要求不可能的事? 我们不应再考虑“会话”或“上下文压缩”。我们正进入一个新世界,终于要从纯文本界面转向语音和多模态。昨天我们跑通一个hack,现在你的Claw可以给你打FaceTime。这才是OpenClaw存在的意义。 八个月里,超过18,...
2026-09-13
Meta新AI应用Muse美区下载量破8万,登App Store第二
Meta的新AI应用Muse于周二上线后,正开始赢得华尔街青睐。这家科技巨头进军Agentic AI领域,也成为业内人士在X平台上热议的话题。早期数据为了解Muse在美国消费者中的实际受欢迎程度提供了参考。 市场情报公司Sensor Tower数据显示,Muse在美国iOS平台下载量已超过83,000次。该应用目前仅限美国地区使用。尽管这一成绩使Muse登上App Store热门榜单第二位,但与...
2026-09-13
北大系公司押注端侧AI:27B模型装进电脑,断网也能干活
一个27B参数的模型原生存在于电脑里,关掉Wi-Fi照样能读取本地文件、翻数据库、处理Excel、写PPT,连续跑过去通常需要调用云端大模型的复杂任务。公司财务数据不用上传,自己的知识经验留在本地,跑得再多也不用盯着随Agent工作时间不断上涨的Token账单。电脑买了,电费交了,剩下的Token随便用。 过去端侧AI唯一麻烦的是模型不太行。1B、3B模型装进手机已不稀奇,但让它读几千条银行流水...
2026-09-13
GPT-6经营售货机年赚1.5万美元,3倍碾压Claude
给AI 500美元、一台自动售货机,放手让它经营一个模拟年,结果如何?GPT-6 Astra交出了一份亮眼成绩单:平均账户余额15,515美元,接近Claude Fable 5.1的3倍。Astra最差的一轮都超过了Claude最好的一轮。这是OpenAI模型首次登顶Vending-Bench 2。 Vending-Bench规则直白:模型拿500美元启动资金,自行寻找供应商、谈采购价、补库存、...
2026-09-13