□本班记者 王萌
一台机器人接到指令后,自主抓取桌签、矿泉水、笔记本,布置好会议桌后,直奔打印机,将会议材料打印好,并将废弃文件丢进碎纸机——全程没有遥控器、没有人工分步提示。这是第二届世界人形机器人运动会办公场景综合服务岗决赛的现场画面。
8月24日,这场备受瞩目的决赛在国家速滑馆展开。机器人走进真实还原的办公室,现场完成一系列“上班族”日常任务,展现了令人惊叹的自主作业能力。最终,海淀企业千寻智能凭借丝滑表现成功夺冠,成为全场唯一全程以模型自主推理参赛并完赛的队伍。
这场比赛究竟有多难?据介绍,办公场景综合服务岗赛事明确要求,参赛机器人需在20分钟内连续完成会场布置、打印送件、碎纸销毁三项任务,每项任务都设有严格的实操标准。在会场布置环节,机器人来到置物架前,识别并拿取桌签、矿泉水、硬板垫等会务用品,按套摆放至会议桌规定位置。在打印送件环节,机器人需要打开打印机,放入A4纸,再从出纸口取出打印材料并送至办公桌指定位置。在碎纸销毁环节,机器人需要识别抓取办公桌的待销毁材料,按碎纸机入口容量分份送入碎纸机销毁。
记者在现场看到,裁判员一声令下,千寻智能机器人迅速启动,从起点出发,前往货架取出会务用品,随后转身前行靠近桌椅,调整至合适高度后开展摆放作业,依次规范摆放矿泉水、桌签、硬板垫,全程操作贴合赛事标准。在后续的打印送件和碎纸销毁环节中,它同样表现出色,动作连贯流畅。
看似行云流水的操作背后,实则挑战重重。据千寻智能赛队负责人王栋介绍,作为所有场景赛中最考验模型通用推理能力的赛项,办公场景“综合服务岗”的核心难点在于高度非结构化的任务环境:柔软易折的A4纸张、细碎多样的会务用品、打印机与碎纸机等多设备交互,没有标准化的工业夹具与固定工位,高度依赖机器人自主识别、自主规划、自主调整动作力度与路径。
本次征战赛场的千寻智能Moz1机器人搭载了公司自研的Spiritv1.6基座模型。比赛过程中,除赛前接收一次初始任务指令外,机器人全程不依赖人工遥操作、分步指令或现场干预,完全由模型自主完成任务理解、环境感知、路径规划、动作执行与结果交付。
这一系列“全自主”表现背后的核心支撑,正是Spiritv1.6的底层技术架构。王栋告诉记者,Spiritv1.6采用VLA与世界模型深度融合的技术架构,让机器人能够在动态环境中边感知、边决策、边调整,无需针对每一个新场景重新编写动作脚本。这一技术此前已在RoboArena榜单、世界人工智能大会(WAIC)与世界机器人大会(WRC)的“客厅整理”公开演示中得到验证,而本次运动会双场景一金一银的成绩,是其在标准化赛事规则下,面向真实商用岗位完成的又一次能力背书。
对于这次夺冠,千寻智能创始人兼CEO韩峰涛表示:“对于通用人形机器人而言,真正的技术门槛从来不是完成某一个特定动作,而是能够跨越不同行业、不同场景,独立完成完整的岗位工作流。千寻智能始终以‘通用具身大脑’为核心方向,这次首秀即取得优异表现,既验证了通用具身大脑跨场景复用的核心价值,也让我们更确信,模型驱动是打开人形机器人真正走进千行百业的核心钥匙。”
一次首秀,背后是一条技术路线的验证。据悉,此次运动会首秀不仅是千寻智能技术实力的一次集中亮相,更标志着以通用具身大脑为核心的技术路线完成了从单点能力验证到可复制规模化验证的关键跨越。千寻智能将持续攻坚机器人通用大脑核心技术,以可复用、可迁移、可复制的模型能力,持续拓展人形机器人的产业应用边界。
