Rabbit创始人吕骋:人不该为Agent改变思考方式
“人说要有光,于是就有了光。”Rabbit创始人吕骋把古老谚语中的“神”换成了“人”:在他的设想中,人只需说出想办成的事,Agent就会自己寻找办法。
Rabbit曾推出橙色手持设备r1,希望用户说出任务,它就能代人操作应用。r1亮相后迅速受关注,但上市后实际体验收到批评。吕骋承认,用户高期待与最初软件体验之间存在落差。上个月,Rabbit开放新一代Agent操作系统OS3:用户从网页或Telegram交代任务,系统调用用户自选的AI模型,让电脑查文件、操作软件、浏览网页或写代码。
谈及为何做跨设备功能,吕骋说自己平时用私人PC、工作Mac和办公室电脑。用户常在多台设备间切换,好用的Agent应让人只交代一次任务,再自行找到对应设备和解决办法。

2024年CES上,Rabbit带r1亮相,但实际体验迅速引发争议,《Wired》给早期产品打出3分(满分10分)。几周前,吕骋接受《Wired》采访时表示,r1已在全球交付超过10万台,退货率低于5%。面对当年批评,他说:“从工程角度看,我们没有押错方向。”他进一步解释落差:“我们在发布会上说能做四件事,然后用户会尝试去做六件事。”在他看来,这种行业早期进入的“前卫”正是Rabbit的底层基因。从r1到OS3,Rabbit想争取的是Agent产品的定义权。
最近一年,Agent正从写代码、处理工作走向个人日常事务。今年9月以来竞争明显升温。OS3发布前后,Meta推出个人Agent产品Muse,据Sensor Tower估算,上线两周下载约280万次。9月初宣布恢复独立运营的Manus随后推出个人Agent产品Cue。国内,阿里千问接通淘宝购物,字节豆包上线对话打车。几家公司路径不同,都在尝试让AI进入日常事务。
谈及个人Agent产品接连出现,吕骋说,模型更会写代码,让Agent更容易造出来;但普通人会不会长期使用仍是未知数。让人用得懂、用得久,才是下一道难题。

OS3操作逻辑简约,只有一个持续对话窗口。用户想到需求可直接说出来,不用先新建项目,不需按工作或生活分类。执行层面,OS3可连接最多五台用户已有电脑,使用各台机器上的文件和软件,并决定任务在哪台机器上完成。吕骋认为,个人Agent要走进普通人生活,首先得把使用门槛降下来。“人类的思考方式,它不是一个文件化的思考方式。”用户不必先把工作和私事分门别类,想到什么就在同一窗口交代。
Meta的Muse推出后,吕骋也试用过。他让Muse买一箱可乐,Muse得在远程电脑上登录购物网站,但因忘了密码,又要打开密码管理器查找。这个过程让他怀疑:个人Agent的需求是否已经得到验证?“让Agent去亚马逊给你买一箱可乐,和用户直接在电脑上点两下买一箱可乐,哪个更方便呢?”他说:“我不认为这个需求已经验证了。”
他用“老板和总助”的关系解释Rabbit愿景:“我有个事儿要解决,你帮我去解决。”现实中,老板不会事先规定助理去哪家门店、用什么方式付款;他要的是结果。吕骋希望用户也能这样使用个人Agent:交互逻辑简单,拥有本地系统权限,还能跨多台设备操作。

打开OS3,主要看到持续对话和输入框,没有按工作、生活分开的任务入口。这种设计足够简洁,也可能让新用户无从下手。吕骋认为,事先替人划好分类,反而会逼人按软件方式整理念头。他说,人的思考是流动的:聊着一件工作,可能突然想起昨天没办完的私事。他把这种状态叫作“brain dump”,即把脑子里冒出的事一股脑说出来。OS3要靠记忆和任务调度接住这些跳跃想法,再决定调用什么工具、让哪台电脑执行。输入框越简单,背后系统要承担的判断就越复杂。
一旦Agent开始干活,光理解指令还不够,还得进入能执行任务的环境。吕骋说,Rabbit早期方案曾尝试类似Muse的方案,却发现异地登录容易触发网站验证,甚至被拦截。因此,OS3尽管仍需云端模型接入,但可把执行程序装在选定电脑上,使用那台机器已有的文件、软件和工作环境。吕骋也把本地执行视为隐私边界:“只要文件在本地,就不用上传,直接执行在本地的电脑。”
使用成本也是门槛。有用户反馈,使用同一模型时,OS3的Token消耗可能高于OpenClaw,这引起吕骋警惕,“我们一定会做一轮深度优化,把这个token使用消耗降下来。”吕骋提到,年初把OpenClaw接入r1后,收到最多求助是“OpenClaw怎么装”。他起初觉得照官网步骤操作就行,后来发现许多普通用户从未打开过电脑终端,更不熟悉GitHub和技能配置。要让个人Agent面向普通用户,一定要尽可能简单,门槛低。
Rabbit把OS3初始设置放进网页端,用户按提示回答问题,再填入自己申请的模型API密钥即可开始使用;若要让Agent操作自己电脑,仍须安装本机程序并授予权限。他形容网页设置是“肉眼可见的改进”,但距离普通人拿来就用还有一段路。“我现在在产品上抓得最紧的一件事,就是如何降低用户门槛。”
谈到OS3为何采用Bring Your Own Key模式,吕骋说:“我不认为任何一家大厂都能在自己的封闭体系里,笃定自家模型会胜出。模型竞争中,没有哪一家拥有绝对优势,也很难在短期内决出胜负
更多推荐阅读

Mistral发布1T参数大胖猫模型,激活仅49B
今天早些时候,美国开源了 glm5.2 级别的模型。随后,欧洲的 Mistral 发布了 Mistral Large 4,又名 Le Chonk 大胖猫。 该模型总参数 1.05T,每次只激活 49B,另带一个 1.6B 的视觉编码器。它采用细粒度混合专家(MoE)结构,模型拆成很多“专家”,每处理一个词只叫醒其中一小部分,因此 1T 模型每算一个词的开销接近 49B 模型。原生多模态,能读文字...
2026-10-07
xAI联创宣判:数学两千年英雄时代落幕
两千多年来,人类最聪明的大脑一直在攀登数学这片山脉。从欧几里得到怀尔斯,每征服一座山峰都要赌上一生。但xAI联合创始人Christian Szegedy认为,这个属于数学的英雄时代正在结束。 Szegedy在长文《数学何去何从?》中,将数学家比作丛林里徒手攀岩的探险家,AI则是一架飞机,已把旗插上没人爬过的山顶。孤独攀登者的时代正在结束,测绘整片大陆的时代正在开启。 Szegedy少年时在匈牙...
2026-10-06
OpenAI疯狂28天首日:模型提速50%却遭评论区翻车
Codex负责人Tibo宣布启动“疯狂28天”计划:未来28天每天要么交付一项Codex/Work改进,要么进行一次完整额度重置。第一天,Tibo宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%,达到50TPS,覆盖官方订阅及Sign in with ChatGPT接入的第三方生态。 但评论区几乎无人关注提速,满屏冷嘲热讽。此前9月29日GPT-6.1 Sol上线后因负...
2026-10-06
AI研究员为何计划逃离湾区买地避难
一些Anthropic最期的员工,最近开始考虑在美国偏远地区买地。他们想过,如果AI真的失控,那里或许可以成为避难的地方。 “一切再也无法平静如初。”一些研究员的电脑上贴着同一句话。 事实上,逃离的念头并非突然出现。十多年来,一群聚集在旧金山湾区的AI安全研究人员,一直在讨论AI失控之后可能发生什么。那时候,Anthropic甚至还没有成立。 有人在伯克利设立共享办公空间,在私人Slack频...
2026-10-06
英伟达押注的Reflection开源新模型对标智谱
英伟达投资的 Reflection 发布首个开源模型 Beam,对标智谱 GLM-5.2。官方称两者在高级推理测试上分数相当,Beam 推理算力仅需后者的三分之一到四分之一。彭博和金融时报称其为美国在开源模型领域对中国的反击。但 Beam 与国内其他头部开源模型如 Qwen3.8、GLM5.3、Kimi K3、DSV4F 仍有差距。 Reflection 由谷歌 DeepMind 两位研究员 M...
2026-10-06
把35个判断交给内核:这个开源项目拿下黑客松总冠军
在进化酒馆黑客松深圳收官之战中,项目 mu(μ)获得全场冠军。它将 Jev 深度融合进 Harness,试图解决 Agent 把工具、日志、技能、上下文全部交给大模型导致效率低、Token 浪费的问题。 mu 建立在开源 Coding Agent pi 之上,主要改造模型外的 Harness,设计了 35 个判定点,覆盖用户输入、工具调用、上下文管理、任务完成判断和多 Agent 通信等环节。例...
2026-10-06