全球首次!杭州造机器人全身协同自主叠衣

全球首次!杭州造机器人全身协同自主叠衣

AI 资讯 来源:新闻/公众号 发布时间:2026-10-10 更新于 2026-10-10 预计阅读 6 分钟

让机器人做家务,是具身智能领域公认的高门槛场景。家庭环境为人类设计,机器人要弯腰、下蹲、转身适应人的空间,家务对象大多是柔性物体,形态随每一次拉扯而改变。更关键的是,真实家务从来不是单点动作,而是一条环环相扣的任务链,任何一处停顿、断裂或失稳,整段任务就要重来。此前不少人形机器人公开演示大多停留在“抓起一个杯子”“叠好一块毛巾”这类单点技能上,一旦任务环节拉长、作业场景切换,连续性与稳定性便难以为继。

全球首次!杭州具身黑马比肩Figure,全身协同自主叠衣

西湖机器人全新升级通用大脑WR1,多项关键能力对标甚至超越海外标杆。WR1采用全球首创的通用大小脑双预训练系统架构,把多模态任务理解与全身控制深度耦合,融合世界模型和视觉-语言-动作模型,依据视觉观察和语言指令,统一输出包含身体移动、全身姿态、灵巧手操作的完整动作序列;全身控制交由原创自研的全球首个通用动作大模型GAE完成高速稳定执行。

全球首次!杭州具身黑马比肩Figure,全身协同自主叠衣

第一段演示瞄准柔性衣物操作。WR1先从晾衣架上取下长裤,像人一样搭在手臂上承托。取衣过程中晾衣架晃动,架上两件T恤位置偏移,机器人持续观察、实时调整,稳定完成取衣。随后将T恤抛送给机械臂,机械臂自主识别衣物并折叠;人形机器人转身把长裤铺展到桌面,与另一台人形机器人协同折叠。两台机器人一边关注对方动作,一边根据长裤实时状态调整配合,把取衣、承托、转移、展开、折叠串成连续操作。其中人形机器人灵巧手自主折叠衣物属于全球首个演示案例,技术难度显著高于业界常见的折叠毛巾、浴巾等规整织物。Figure过往演示更多集中于规整物品操作、被子铺展、简单织物整理,尚未展示对抗外部扰动下的衣物取放、双机协同折叠这类高难度柔性任务。WR1需持续抵消晾衣架晃动、布料形变、双机协同带来的多重扰动,在柔性动态物体处理能力上实现对Helix方案的超越。

全球首次!杭州具身黑马比肩Figure,全身协同自主叠衣

第二段演示考验全局调度与长程任务处理能力。WR1先经过较大范围移动,准确抵达冰箱前,开门取出玉米;随后以流畅快速的U型转弯来到空气炸锅前,调整站位,握住把手拉出炸篮,将玉米放入。接下来下蹲握住收纳筐把手,把沙发和茶几上的玩偶顺势拨入筐中,再走到床前整理被子。一条任务链跨越厨房、客厅、卧室三个家居区域,全程连贯执行,没有中断,无需中途人工复位、无需分段下发指令,一次性跑完多场景复合家务任务。

拆解两段演示,真正决定成败的是三项底层能力协同:柔性物体泛化、跨场景长程任务执行、流畅的运动操作一体化。三者分别对应家庭场景的三个核心挑战:对象形态不可控、任务链条长且跨域、动作衔接要求高。柔性物体泛化首先直面家庭环境,衣物位置、布料状态与协作姿态随时在变,WR1保持观察、实时调整,将任务复杂度从单次抓取与平面折叠拓展到动态扰动下的连续衣物整理与双机协作,面对形变、外力扰动不会因物体状态偏离预设就直接任务失败。跨场景长程任务执行难度更进一层,对象、方向、站位、身体高度都在变,任务却不能断,机器人既要完成每个环节,又要守住任务顺序与动作衔接。长链路任务中单步成功率再高,步骤一多整体成功率就会快速衰减,这是行业共同痛点。WR1展现的正是不同空间、不同对象、不同操作之间的连贯转换。而把这一切串成“一镜到底”观感的,是WR1的高动态能力——流畅的运动操作一体化,身体移动、姿态调整与手部操作始终紧密咬合,脚步、躯干与双手围绕同一操作目标协调联动,衔接处的停顿与突变在机制层面被压到最低。

三项能力从何而来?答案落在通用大脑与全身运动操作的分工,以及关键词“贯通”。通用大脑侧,WR1结合多视角视觉观察与自身状态,在同一段动作序列中统一生成移动、姿态与手部操作指令,由任务管理模块组织指令与任务流程,脚步、躯干与双手率先实现贯通。为保证长程任务中的动作一致性,WR1引入长短时运动状态回顾机制,让模型识别身体当前所处的运动阶段,为后续动作生成上下文。实时动作分块机制在生成下一段动作时把正在执行的轨迹纳入考量,机器人继续运动的同时模型已在准备后续动作,从机制上减少动作更新带来的停顿与突变,实现时间维度上的动作贯通。运动侧,GAE承担全身动作跟踪与平衡控制,通过大规模、多来源的人体运动数据和两阶段训练,覆盖行走、转身、下蹲、伸展等动作,为跨区域、跨高度操作提供统一执行基础。可调节的前瞻机制负责补偿执行延迟,与动作衔接机制共同保障执行连贯,让通用大脑意图与硬件执行无时差对齐。真正让WR1路线与众不同的是端到端贯通:GAE同时承担示范采集与自主执行两个阶段的底层控制,训练示范与自主执行共享同一套控制基础,从根源上压缩学习与执行之间的落差。“想清楚”与“动起来”在同一条链路上贯通,这正是WR1能把长程家务做连贯的底层原因。

西湖机器人科技(杭州)有限公司是西湖大学人工智能与机器人领域首个成果转化项目,坚持通用大脑+人形全身小脑+自研人形本体三位一体全栈自研路线

标签: AI 资讯 AI

更多推荐阅读

OpenAI两篇论文将挂谷猜想推至四维

OpenAI两篇论文将挂谷猜想推至四维

今年7月,王虹、邓煜在费城国际数学家大会上拿下菲尔兹奖。消息刷屏时,Anthropic员工Alek Dimitriev在X上称,这将是人类最后一次拿到该奖。往届得主Timothy Gowers跟帖表示自己也有类似想法,但认为过程会有滞后,大概能撑到2030年。 10月7日,OpenAI一口气放出722篇数学手稿,论文和部分Lean证明上传GitHub。其中编号074的一组只有两篇,正是王虹获奖方...

2026-10-10
豆包上线生活缴费功能,AI对话可缴水电燃气费

豆包上线生活缴费功能,AI对话可缴水电燃气费

豆包新增“生活缴费”功能,用户可在豆包App内通过语音或打字发起水、电、燃气等缴费指令并完成操作。接近豆包人士表示,豆包正在逐步建设包括出行服务、生活缴费等生活场景下的办事能力,持续拓宽AI产品的办事边界。 与微信、支付宝先建功能入口再让用户查找的思路不同,豆包以大模型对话作为调度层,用自然语言指令唤醒各项现实服务。这种方式比上个时代的超级App更便捷,屏幕能展示的服务有限,但通过对话唤醒的服务...

2026-10-10
OpenAI年化营收差200亿美元,英伟达跌近3%

OpenAI年化营收差200亿美元,英伟达跌近3%

10月8日,英国《金融时报》披露,OpenAI向投资者提供的文件显示,截至9月底,公司年化营收接近500亿美元,低于此前广泛报道的接近700亿美元。9月底媒体口中的数字还是接近700亿美元。这份报道加剧了市场对AI增长的担忧。当日收盘,英伟达跌约2.9%,甲骨文跌约5.5%,纳斯达克综合指数跌1.25%。 不到一个月前,Anthropic还传来盈利进展。9月13日,路透援引《金融时报》报道称,A...

2026-10-10
港大教授创业做dLLM,拿下全球最大融资

港大教授创业做dLLM,拿下全球最大融资

10月9日,投中网独家获悉,扩散智能DiffuSpace已连续完成两轮融资,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投,总金额达数亿元,创下全球扩散语言模型最大规模融资纪录。 DiffuSpace团队研发的Dream 7B在全球扩散语言模型中居于领先位置,部分能力可比肩DeepSeek V3(671B)。在ICML相关演讲中,Dream 7B与Google Gemi...

2026-10-10
30人公司5天AI化改造:痛点与突破

30人公司5天AI化改造:痛点与突破

过去很长时间,我都在思考AI时代公司同事应如何协同。我们公司刚30多人,但人人都用AI,人力、财务、运营、内容、行政、商务都会Vibe Coding自己的产品,甚至为同事创造产品。比如财务为商务同学做了一个开票助手,打通项目表,申请后飞书机器人通知,核对后一键开票,双方都爽。但痛点仍在:大家创造的应用如何部署、做权限管理、只让特定人用,以及Skill的协同分发,都很困难。这需要顶层规则,但一直忙,...

2026-10-10
谷歌下一代Gemini 4 Carbon曝光,性能逼近Opus 5.5

谷歌下一代Gemini 4 Carbon曝光,性能逼近Opus 5.5

谷歌Gemini 4 Argon尚未公开发布,其下一代模型Carbon已作为绝密项目在内部上线测试。据悉,谷歌正在内部编码平台Jetski中测试代号为“Carbon”的检查点,其性能已逼近Opus 5.5。多位员工透露,递归自我提升(RSI)是取得这一进展的关键,即AI能自主发现代码错误、生成更优解决方案并内化为自身能力,实现加速进化。 此前,谷歌于10月1日发布Gemini 4 Argon,据...

2026-10-10
订阅
关注

扫码关注公众号「60秒看懂AI」

扫码关注公众号 60秒看懂AI

微信搜索「60秒看懂AI」也可关注

顶部