办公Agent实测:豆包工作如何把复杂任务干成半个实习生
办公Agent赛道竞争白热化,字节跳动近日推出独立“豆包工作”应用,将办公Agent能力整合其中,与豆包App、飞书形成三大入口,覆盖B端至C端。实测显示,这款应用不仅能完成复杂旅行规划,还能创作营销物料、代管群聊,正在重新定义AI助手的边界。

随着大模型能力普及,办公Agent成为各家争夺的制高点。字节跳动选择以独立应用承载这一能力,而非全部塞进豆包App,显然意在打造更纯粹的生产力工具。豆包工作内置飞书连接器,可以读写飞书文档、表格、日历和群聊,天然打通个人与组织的协作场景。这意味着它不像一般聊天机器人那样只能处理孤立提问,而是能深入到工作流内部,成为组织资产的一部分。

实测一:复杂任务执行

测试者给出一个相当繁琐的需求:规划8月30日至9月7日的东京行程,要求指定酒店区域、考虑人数变化,餐饮必须是食べログ百名店且包含米其林,餐品不能重复,每天游览景点不超过三个,同时还要参考抖音博主@Geo杰欧的视频。豆包工作快速生成一份PPT行程,基本满足所有硬性条件。更关键的是,初期它仅依据博主标题文案来规划,当用户明确要求逐条查看视频后,它便打开抖音挨个观看相关视频补充信息,体现出自主收集信息的能力。行程还附带动态地图网页,当用户把“惠比寿”改成“五反田”时,地图上的坐标、动线以及介绍文案都同步更新。这种局部修改的联动性,正是复杂任务落到实处的关键。

实测二:多模态内容创作

用户要求为“野生狗奶”制作苹果风格官网和电商详情页,这显然是个带着幽默感的题目。豆包工作起初以食品安全为由拒绝,在用户解释为艺术项目后,它才同意继续。生成的官网审美在线,详情页巧妙融合网络梗,展示出图像生成与文案能力的结合。这个案例说明,办公Agent不仅要会干活,还应具备对语境的理解和判断,能在规则与创意之间找到平衡。
实测三:连接器与技能
豆包工作内置飞书连接器,使其能够读写飞书文档、表格、日历和群聊。测试中,它先阅读用户过往文章,总结出写作范式,然后代表用户在群内对话,可以每15分钟监控并回复消息。用户要求区分工作与闲聊语气后,它的回复风格变得逼真,几乎与真人无异。此外,豆包工作还能自动将文章转为短视频,并调用本地技能,进一步模糊了人与AI协作的边界。
办公Agent的核心不在于能力上限,而在于能力下限。所谓能力下限,就是那些基础但繁琐的执行环节能否稳定、不出错地完成。豆包工作的真正壁垒在于上下文处理能力,它需要理解文档、群聊、会议纪要等组织资产,并在此之上进行推理和行动。只要飞书生态保持稳固,豆包工作就能持续享有这种组织协同带来的优势。对于多数企业来说,办公Agent只要达到半个实习生的水平,就能显著提升效率、降低成本。这或许才是办公Agent落地最实际的判断标准。
更多推荐阅读

世界模型专家刘宇加盟理想,机器人基座模型研发提速
理想汽车引入世界模型专家刘宇,负责机器人基座模型研发。刘宇曾想创业做“中国的π”,因认可理想智驾VLA路线而加入。理想近一年流失13位核心高管,刘宇的加入为团队注入强心剂。
2026-09-05
AI办公赛道巨头混战,Agent创业窗口反而开启
2026年夏,字节、腾讯、阿里会战AI办公,巨头重兵投入背后是恐惧。创新工场汪华称,国产模型能力与成本突破才真正点燃Agent爆发,创业公司反在巨头照亮市场后觅得细分机会。
2026-09-05
AI报告读着累?新指标用隐喻率量化可读性
Manus团队提出“隐喻率”与“信息量”双指标,量化AI调研报告的可读性与信息密度。测试发现Claude Fable-5隐喻最多,GPT信息密度偏低,但可通过Prompt优化。
2026-09-05
AI科学家K Pro上岗,全球最大药企研发提速70%
Owkin与勃林格殷格翰达成许可协议,授权AI科学家K Pro及多模态数据,加速肿瘤学和免疫学新药研发。试点项目已显成效,靶点识别速度提升70%。
2026-09-05
估值300亿美元,AI云新贵Crusoe凭什么吸金超30亿
Crusoe完成超30亿美元融资,估值达300亿美元,与OpenAI、微软、Meta等合作,并获Jane Street五年大单,AI算力需求推动其估值飙升。
2026-09-05
AI攻克费马大定理:Claude 11天写出1300万行证明
Anthropic宣布,Claude在清华姚班毕业生彭天翼团队带领下,仅用11天完成费马大定理的首个端到端机器验证证明,产出1300万行代码、30300条定理,规模超Mathlib五倍,烧掉60亿Token,引发数学界震动。
2026-09-05