2026世界机器人大会的一个可观测变化是:场景化工位demo中,人工介入频率明显下降。

球台对打、茶艺操作、传送带分拣等展台,任务切换环节不再依赖工程师现场接管或重置系统——同一台机器人在完成泡茶后接续递杯动作,物料规格变更后自主调整抓取位姿,全程不回原点、不重训运控策略。对比2025年同期,展台标配的"急停按钮值守位"在本届多数核心厂商演示中已撤出主工位。


这一现场变化对应的技术背景是:具身智能行业在2026年上半年出现架构收敛。智元(快慢系统+世界模型)、北京人形创新中心"慧思开物"(VLM大脑+运控小脑)、宇泛(异构双脑)、Physical Intelligence(VLA叠加世界模型子目标)等方案表述各异,但公开技术论述中共同指向同一问题——大脑(语义/任务层)与小脑(运控/执行层)单独迭代的边际收益收窄,瓶颈落在双脑间的时序对齐与上下文传递:高层语义指令如何映射到关节级动作序列,任务切换时状态上下文如何在两层间无损接续。

WRC 2026现场无接管连续作业demo,验证的正是这一环节的初步打通。其工程意义区别于此前"后空翻"类高动态动作demo:后者验证的是单点控制极限,前者验证的是任务层与运动层在开放序列下的协同稳定性——后者与产线部署的距离更近。

01.

决策和运控合流是共识,合法路径不止一条

决策和运控合流是共识,合法路径不止一条。这条线上最值得盯的不是谁翻了跟头,而是球台边,动易科技走一套名为"物理智能体"的实现路径,兼具智能决策与稳定运控能力。在PhyAgents体系里,PhyAgent承载上层决策,PhyCore负责底层运控,两个模块从强化学习训练阶段就共用同一套状态-动作空间,部署时无需额外中间件话题完成跨脑通信闭环。

验证场景选羽毛球再切乒乓球,不是因为好拍视频,是球类把高动态环境、毫秒级智能预判、下半身移动配上半身击球的全身协同、落点重规划全压进同一个闭环,比平地行走难出一个量级。


C2(135cm双足)链路是:人类示教给初始策略,大规模仿真自博弈预训练,真机微调,部署端上扩展卡尔曼滤波做轨迹预测。据动易科技透露,今年4月广交会期间C2面向境外客商首次开放实机与人自主对打体验,无预设无遥控器;7月广州"够C羽球馆"商场快闪店开放环境下近万人次进场体验,单日峰值上千次交互。WRC现场展示的乒乓球对打,依托PhyAgents框架完成能力复用迁移,无需从零完整重训全身协同策略,仅针对新任务微调感知参数与末端动作约束。


M系列(180cm/75kg)是其全尺寸重型电驱人形机器人,已展示拟人态后空翻动作。D系列轮足复合四足D1整机自重130kg,官方标定常态动态载重210kg、静态极限承压可达500kg;展会演示中可攀爬45斜坡、跨越85cm高台,在废墟、碎石复杂地形实时动态调整重心与步态。动易科技的工程逻辑不绕弯:先把全尺寸重载平台的极限通行、承载工况跑通、结构不散架,自研PhyAgents部署上去才有可靠硬件底座。

本届WRC上,这条"世界模型端侧化、与运控体系打通统一时序"的收敛线,体现在球台边、茶具旁、传送带和旋转工作台前,各家技术封装的命名语法不同,指向却是同一件事:具身智能上半场拆开迭代的大脑和小脑,下半场必须合流,世界模型不能只挂在云端,要沉到端侧、跟底层运控共用同一根时序信号。

02.

工厂到底在等什么?里工、越疆、埃夫特给出自己答案

如今不少成熟工艺场景里,单台机器人本身的重复定位、运动精度基本能满足生产需求,真正拖慢产线落地、制约量产效率的痛点,更多集中在多工序、多设备之间的时序协同衔接上。

离散制造的真实工况不是单站拧螺丝。A站做完,料箱上传送带,B站取件,中间有缓存位、节拍波动、工装夹具位置漂移、异常停机。单机再准,节拍对不上,整条线还是停。

里工(智创馆 C205京东展台)今年展示的方案是“双机协同·电机拆解与重组工作站”:两台里掂 F1 轮式人形——20 自由度、腰三折叠、双臂总负载 42kg——加旋转工作台和物料传送带,完成电机零件拆解、分装、传送、重组装、成品回位的完整循环。


该工作站围绕典型工业任务逻辑搭建,在复刻真实产线运行逻辑的基础上实现稳定作业循环。项目核心难点并非只是机械臂运动精度,更考验多设备协同时序调度能力。方案重点验证两台里掂 F1 的任务分工、跨机器人工序交接,以及人形机器人与传送带、旋转工作台等外围自动化设备的深度流程联动能力,解决离散工业现场多机协同、设备节拍对齐的落地难题。

里工展示方案对应的,恰好是实景实训专项行动里“生产制造/维修维护”的真实需求:机器人不再停留于实验室里的“单机作业”,而是走进工厂开启“作业模式”,真正融入人、机、环境,在真实工况下协同作业、共享时序、应对异常,并持续稳定运行。

乐聚在WRC2026把工厂产线1:1搬进展台,夸父5W在纸箱拆垛、料箱搬运、小件上料三条工位上连轴转8到10小时,箱体歪了自校准,无遥控无工程师兜底。


它不讲架构故事,走Taskor图形化编排,产线工程师拖模块不写代码,单机部署从数月压到数小时,新技能3到7天跑通。纸箱拆垛在海晨仓库跑出95.8%成功率,塑料箱拆垛已切入一汽、江汽产线,小件上料在兆丰机电抓十几种零件;商服导览全国落地23省,单一场景下累计接待4306场,稳定运行455天。

和里工互补,乐聚交的是另一张卷:量产本体加低代码工具链,把单站工序在工厂真替下来——部署周期和复购订单能同时压住的,才算过了采购关。

在越疆展台,真正吸引眼球的并非单一机器人的炫技,而是一套名为“一脑多体”的具身智能平台,同一个越疆自研空弈DobotWAM具身大模型,驱动着形态各异的机器人各展所长:产线上,人形机器人、四足机器狗与协作臂无缝接力,完成从分拣、转运到装配的完整工序;家庭里,机械臂自主识别并折叠衣物;展区中,全栖人形机器人鹿萌可自主导览、对话互动,甚至与观众打乒乓球。所有场景共享同一套环境认知、决策与力控能力,不同本体“各司其脑”却“共用一个大脑”,真正实现群体智能的协同进化。


“一脑多体”打破了传统机器人“一机一用”的局限,让智能在不同形态本体间自由迁移,大幅降低了场景适配的门槛。越疆不是在做一台更聪明的机器,而是在构建一个能快速复制、泛化到多种物理载体的智能底座。无论是工业、家庭还是文旅,同一个大脑可以灵活指挥不同的”身体”,这才是具身智能走向规模化商用的关键。

埃夫特×启智 Openmind(A106)从工艺侧往下打。HumanGPT 负责把车间老师傅的实操工艺经验沉淀、蒸馏为标准化多模态工业知识库;大衍数据平台打通数据采集、清洗、标注、训练全流程;墨斗 IDE 提供低代码拖拽方式快速生成机器人作业技能;Openmind OS 向下兼容各类硬件设备,向上承载上层业务应用。


落到整机实操层面,智能焊接依托 3D 视觉自动识别焊缝、在线生成运动路径,无需人工复杂示教即可一键启动作业;智能喷涂仅需放入工件,经由点云建模、大模型生成运动轨迹、仿真微调后直接投产;EXR 系列防爆机器人具备正压防爆、IP65 防护等级,适配化工、军工、民爆高危场景。

再叠复合机器人和线边仓 SPS 分拣——后者已在某主机厂投产,百种零件 3D 识别抓取,从来料到上线无人闭环。和里工一上一下:里工验证"多机加外设怎么不打架",埃夫特×启智解决"复杂工艺里模型怎么理解图纸、怎么把喷涂焊接技能从人身上扒下来变成可复用资产、怎么闭环修正"。

单机精度红利在收敛,工序级闭环正从加分项变成工业具身的必答题。

03.

泡茶、做披萨、整理床单——这些"不酷"的事为什么反而最难?

服务机器人赛道过去三年最大的问题是:视频越漂亮,落地越尴尬。机器人泡一壶茶,换杯子形状就傻,换台面高度就卡,换个口音就乱。

优理奇(UniXAI,智合馆)这次拟集中呈现机器人乐队、工夫茶、水墨画、披萨、酒店客房、家庭早餐六个场景,底层同一套三件套——UniCortex 长任务推理、UniFlex 少样本泛化、UniTouch 视触觉融合。它值得看的不在"茶泡得好不好",而在证明同一套栈能从文娱跨到餐饮跨到客房:泡茶八步可迁移到换壶型,披萨九步跨设备流程可迁移到商用厨房,水墨画连续笔锋控制可迁移到涂胶喷涂。不过需要强调的是,不同场景仍需针对性适配调试。

同馆的千寻智能走的是另一条线:长程推理+多机班组。WAIC上Moz1搭Spirit v1.6做过"整理客厅"——可乐归位、脏碗进洗碗机、纸团干扰后重规划路线;Moz2 奶杏色机身定位商服。WRC我们看到的是双机展出,重点不是两台机器各干各的,是复杂服务任务里的分工调度:一台感知规划、一台执行精细操作,状态在两者之间实时同步。


这正好是"岗位"从单机走向班组的前奏,服务机器人过去卡在"单岗能干活",下一步卡在"多岗怎么交接上下文",千寻把 Spirit 的推理链打开给人看,比单台泡茶更接近真实前台/客房的班组结构。

维他动力 Vbot(C馆 C108)首款人形具身智能终端 ATOM 在 WRC 首次公开亮相。核心团队具备汽车和自动驾驶背景,将安全、可靠与工程闭环带入生活空间。AI 载物机器狗「大头」首销6,540台,并于2026年5月实现量产交付,目前是消费级具身智能销量第一;126万次大模型交互、131,500小时陪伴和三个月4次OTA,让Vbot跑通了规模交付、真实使用与持续迭代的消费终端闭环。


ATOM与四足产品共享“Vbot Embodied Genome|具身基因组”具身模型体系,由Vbot-OmniDuplex、Vbot-WorldModel、Vbot-EvoMorph三大核心模型连接连续交互、未来推演与跨本体进化。ATOM以160cm身高、180cm臂展和31个本体自由度,从桌面、货架、门把手等人类尺度反向定义身体,面向拾取搬运、物品收纳、按键操作等生活服务任务。它的发布,代表Vbot正将已验证的产品化能力延伸至人形机器人,推动人形机器人进入产品化时刻。

消费级意味着成本结构、安全冗余和交互范式全部重算,不是工业人形缩小降价,而是从真实用户和长期服务倒推产品定义。与从实验室原型或商用场景切入的路径不同,Vbot从已验证的四足消费终端出发,把量产交付、用户运营和OTA闭环扩展到人形。起点不同,终点都是“生活空间里的连续服务”。

04.

进银行当大堂经理、进展馆当讲解员,交互智能到底在解决什么?

人形进家庭之前,有个被运动叙事长期盖住的问题:进了门,待不住。

银行大堂、展馆、养老院——每天在岗 8 小时,不拼爆发力,拼"认得出对面是谁、记得住上次聊到哪、角色不串台、被拒绝怎么接话"。PPT 里叫"交互",落地时叫留存率。

EIR(四川具身人形机器人科技有限公司)走的是国内少有的交互智能路线。爱湫人形交互版挂 ELA 模型,runtime 层统一编排感知、记忆、角色、导航、运控,同一台机器进银行是大堂经理、进展馆是讲解员、进文旅是 IP 伙伴——换的不是壳,是 Skills、知识库、人格设定。3D 数字面孔承载表情,7 自由度臂加三指夹爪补"会做"的能力。

它参与运营四川省人形机器人训练场 B 场,实跑中交互失败、用户打断、人工接管的数据回流反哺 ELA 模型,场景入口加训练场闭环,是交互路线能跑通的基础设施组合。按 EIR 桌面机产品思路,爱湫·开放式交互头把数字面孔拆出来单独卖,企业接自己的模型和 IP——整机进家庭还早,先让数字员工进场景攒数据。

但交互留存率最后崩的往往不是话术,是手。角色感再稳,最后几厘米"递证件碰到人、递水杯力度没收住",用户体感立刻从"有个角色在"变成"这机器手太硬"。靠视觉猜接触力,永远差一截。

他山科技(智合馆 B218)卡的就是这个位置,TS-F系列全手传感器模组、TS-ECHO 触觉感知指套、TS-EST 多模态电子皮肤,配自研触觉芯片做信号前端处理,做的是交互型机器人手上的"力觉知觉层"。运动路线里触觉解决"别捏碎"、别撞、别滑,那是安全冗余;到了服务交互场景,触觉解决的是另一件事:接触时的分寸感。养老递药碗、银行递回证件、酒店递房卡,力度过冲人皱眉,力度不足东西掉,每一次接触都是一次信任投票,触觉是交互下限的物理执行器。


基础单目视觉模组如今已经卷到百元级区间,但服务交互需要的触觉,依旧面临精度漂移、使用寿命、数据一致性等挑战。大面积柔性触觉套件整机 BOM 成本偏高,标定流程繁琐,批量良率波动大,不少整机厂商在展厅演示阶段会简化触觉闭环,只用视觉估算接触力,这也是展台上机器人递水杯、递证件只能慢动作、固定轨迹、预留 20 厘米安全距离的核心原因。


真到银行大堂早高峰、养老院护工不在旁边的时候,没有触觉闭环,交互型机器人手伸出去的那一下就是留存率断崖。他山这类触觉公司,走在"交互路线想从演示进量产"的必经节点上:嘴上那套靠场景数据迭代,手上这一克力,得靠传感器先过关。

服务场景的留存率不来自运动上限,来自交互下限,从角色记忆、数字面孔,到手伸出去最后几厘米的那一克力。今年开始有人愿意把这个说透了,比翻跟头值钱。

05.

人形展台最热闹,但真正跑出复购订单的为什么是"不像人"的?

如果翻看电力、消防、园区巡检特种场景的复购清单就能发现,现阶段落地采购主力仍是四足、轮足机型,人形机器人受地形适配、标定成本等约束,批量复购规模暂时落后。


云深处(C220)"一人一猫一狗"矩阵再次在WRC现场呈现。变电站里四足为什么比人形先铺开?不是技术不行,是楼梯加碎石加电缆沟的场景里,四足重心低、轮足过坎省电、人形每多一个自由度就多一份现场标定成本。

国网南网复购的不是"像人",是"半夜自己巡完30个间隔、数据回传、人不进场"这件事。山猫轮足在山地消防前置侦察替代第一批进火场的队员,绝影在隧道替代持表抄数的工人——特种采购的 KPI 是"替代谁、省几个人、出不出事",不是演示视频时长。

松灵机器人(智趣馆 D306)此次展示七轴同构示教器与行业底盘等产品,延续模块化、平台化的机器人开发思路。相比围绕单一本体形态竞争,松灵更强调移动与操作能力的解耦组合:高校科研可基于标准化底盘快速搭建移动机器人平台,行业客户也能针对物流、巡检、操作等任务灵活集成。

这背后对应的是具身智能从“单一本体”走向“平台化能力”的趋势。机器人进入真实场景后,需要解决的不只是运动能力,更是移动、感知、操作与上层算法的快速协同。底盘也不再只是行走机构,而是连接不同能力与应用场景的重要基础平台。松灵通过移动底盘、机械臂及开发生态的组合,为机器人科研与行业应用提供灵活、可扩展的开发平台。


人形本体侧,逐际动力人形机器人Oli、Luna,与TRON 系列双线并行。 在展会现场,逐际动力把“人形大脑系统”具象化,Oli化身赛博主持人,与观众聊天问答、即兴起舞热场,还能使用英、韩、法、日等多国语言交流,主要展现了System 2(认知层)自主交互的能力;TRON 2通过全自主VLA操作给观众送糖,主要展现了System 1(技能层)的能力;依托WBT全身运动基础模型,Oli与动捕演员现场演示“身外化身”:快速挥臂、扭腰抖肩、深蹲、打八段锦、跳舞等任意长程动作均可实时复现,全程平衡稳定、动作精确。Luna通过群控技术演绎不同风格的舞蹈,展示了System 0(运控层)的能力。同时,通过TRON 2,体现机器人不只有一种“形态”,还能像拼乐高一样自由组合。

智身科技今年亮相WRC,真正想让人看懂的,不是又发布了哪款四足机器人,而是当全栈技术底座走向成熟之后,能力如何一层层向不同形态延展。

从关节模组、感控一体运控,到ZSD端到端导航大模型,智身科技坚持全自研起手,先把底层底座吃透。随后,四足机器人成为这套底座的第一个量产落点——相比人形,四足在地形适应和标定成本上更友好,能让场景数据率先转起来。

当动力总成、量产供应链、场景闭环这三件关键事项被四足机器人逐一跑通,同一套底座便开始向更多形态生长:一方面是人形机器人智身银毅NE01,实现全身协同;另一方面是轮腿平台智身铜锤M1搭配机械臂智身铁臂TA01,落地VLA操作。末端稳定性的难题,依靠小脑级全身协调来解决,而非另起炉灶、重新来过。

智身科技并非"计划进入",而是已经在真实场景中运转。携手300余家生态合作伙伴,智身科技已跑通多类成熟应用,落地安防、应急、电力等核心行业,服务覆盖全国超百个省市地区。

06.

今年世界机器人大会,你该怎么逛这个展?

五条线叠在一起,WRC 2026 真正考的不是"像不像人、翻不翻得动",是同一件事:从单点动作到完整任务的闭环,谁真的跑通了。

今年世界机器人大会,建议大家别先往人形最大的展台挤。先看谁旁边摆了传送带、旋转台、烤箱、球台、床单、茶具,有真实工位道具,且工程师没拿遥控器,机器人自顾自跑了半小时以上,那才是今年该盯的东西。

后空翻的视频三个月前拍够了。今年大家来交的,是能不能在物理世界里不打断地干完一整件事。

追加内容

本文作者可以追加内容哦 !