2026 WRC甩出工业商用家庭消费实景应用答卷,优必选的底牌是具身智能
2026-08-21 02:59:15
智东西
作者 | 程茜
编辑 | 漠影
智东西8月20日报道,世界机器人大会(WRC 2026)开幕,上下游产业链的机器人企业纷纷拿出看家本领,对比往届,大批真机实干的实景演示轮番登场,成为本次大会的重头戏。跳舞打拳或许仍然有流量,但行业已经不再为此买单,人形机器人的竞争,已经悄悄转移了赛道。
优必选的机器人“打工天团”直接在展台上组团开工!Walker C1摇身一变展台主持人,智能讲解、导览接待一手包办;另一边,超十台Cruzr Y1、Cruzr S2火力全开,在复刻的工厂产线里实景上演汽车钣金上下料、机加件上下料、纸箱和料箱拆码垛、电商小件分拣四大任务,完整展示出一条从工业生产直通仓储物流的作业闭环。

除此之外,优必选最新发布的面向家庭消费场景的超仿生人形机器人优世界U1也在WRC首秀,吸引大批观众驻足排队,沉浸式交互体验,成为展会超高人气焦点。
这也是优必选首次系统性亮出其人形机器人聚焦工业、商业、家庭消费三大场景的应用布局成果。
这场大会便是机器人产业当下转型的一个缩影。回看具身智能发展早期,赛道比拼的焦点大多停留在硬件参数、炫酷的仿生动作与外观表演;而当人形机器人从展台秀场走向真实岗位,软硬件一体化的场景适配、复杂环境下自主完成任务的落地能力,才会成为新的核心竞争壁垒。
正是基于这一行业趋势,优必选还有世界机器人大会上诸多厂商展出的核心看点,已不再是单款产品亮眼的纸面参数,而是一套覆盖多场景、可复制落地的产业生态闭环能力。
优必选科技副总裁、具身智能与人形机器人研究院院长焦继超感触最深的一点也是如此,他认为当大家都去选择能落地、能创造商业价值的场景,如今受限于算法、基础大模型能力,其可选择的赛道会慢慢趋同,而进入具身智能下半场,就是真实场景落地能力、商业化能力与订单转化能力的终极较量。
对于优必选而言,这些真实场景落地背后的关键,正是其自研的具身智能大脑,以及在不同场景落地构建起的行业稀缺数据飞轮闭环。
一、具身智能核心:让机器人兼具“会思考的脑子、能运动的身子”
具身智能的核心,就是让机器人真正长出“会思考的脑子、能运动的身子”。
但当下的痛点是不少机器人算法与本体硬件未能实现深度适配,且模型本身能力有局限,导致机器人很难胜任高精度作业任务,尤其在非结构化的复杂真实场景中落地困难。
针对这一挑战,优必选在硬件选型上做了针对性取舍。以减速器为例,表演型机器人多采用行星减速器,成本较低但精度有限;而优必选工业人形机器人则选用高精度谐波减速器,虽成本更高,但凭借工业级精密传动结构,显著提升了作业稳定性。在芯片层面,普通跳舞机器人搭载的RK3588端侧芯片算力有限,仅能完成基础图像解码和简单识别,缺乏自主决策能力;优必选则选用英伟达Thor芯片,其高算力足以支撑多传感器融合、实时环境推理、世界模型预测和动态任务规划。
此外,在软件层面,优必选还走了一条全栈自研的技术路线,搭建起“基座模型-世界模型-行动模型”三层技术栈。从底层认知到上层决策形成闭环,旨在从算法端补齐硬件能力,努力打通从感知到执行的最后一公里。
先来看其自研的基座模型,因为业界的通用大模型大多面向互联网图文交互训练,缺乏对物理世界规律、机器人运动认知,因此优必选专为具身智能场景打造了基座大模型Thinker。
今年2月,这一模型一开源就拿下了不错的榜单成绩。Thinker 1.0在涵盖10B以下具身智能大脑模型权威基准评测中斩获9项第一,最大基座模型达100B。
但如果机器人只能看见当下,无法预判未来环境的变化,长时序复杂任务便无从谈起。今年5月,优必选的具身世界模型Thinker‑WM发布,采用多模态融合架构,长程任务能力已登顶具身智能操作能力评测基准Libero榜首。
与此同时,世界模型的价值还在于为其打开一条低成本的数据破局之路。
一方面其能通过知识蒸馏技术,将世界模型的物理认知能力迁移至下游操作任务,训练轻量化VLA模型,降低真实硬件交互的数据依赖;另一方面可自主生成符合物理规律的多样化场景、极端工况与稀有动作交互轨迹数据,补齐真实场景中的长尾数据短板,替代高成本的实地数据采集,降低技术迭代与落地成本。
认知与预判最终要落地为机器人的精准行动,优必选的最后一块拼图就是VLA(视觉-语言-行动)模型。其采取了分级落地的策略,让不同规模的VLA(视觉-语言-行动)模型匹配真实场景的差异化落地需求,其自研的Thinker-VLA涵盖Lite/Pro/Max多版本,参数规模在1B~100B之间不等,适配工业、商用、家庭等多元场景。

值得一提的是,优必选还联合英伟达完成了Thinker‑VLA纯端侧部署,让机器人无需依赖云端算力,便可在本地实时工作。
这已经在实际应用中得到验证,工业场景Thinker-VLA推理效率提升176%,存储用量降低60%,端侧全功能模块GPU芯片存储需求由64GB优化为32GB;在商用服务与家庭陪伴场景中,Thinker-VLA让机器人拥有对话、问询、表情、眼神、记忆等多维交互能力。
在此之上,一条基座模型认知、世界模型推演、VLA模型让机器人行动执行的闭环链路就此打通。这套完整的Thinker具身大脑体系,最终构建起从智能算法、软硬件深度适配、工程落地再到真实数据反哺迭代的全链路自主可控体系。
二、“脑身合一”的三线布局,验证人形机器人规模化能力
如果说前文的模型、部署、数据全栈布局,是为机器人打造了会思考、能进化、可落地的超级大脑,那么真实应用场景,就是检验这套大脑能力的“实战场”。
优必选瞄准了工业、商用、家庭三线布局,这并非简单多点撒网,而是一套兼顾商业化与长期技术进化的战略。
一方面现有的机器人能力有限,尚未达到通用落地水平,另一方面,这套方案能为其后续模型迭代提供跨场景数据、拿下商业化订单。
焦继超谈道,基于此,优必选就形成了在工业场景训练机器人的操作能力,在商用场景注重全身控制、交互能力,陪伴场景训练情绪识别的布局。
在这样的考量以及全栈具身大脑的布局下,优必选在世界机器人大会上交出了答卷。
在零部件上下料、拆垛码垛、物流电商小件分拣各作业场景中,Cruzr Y1、Cruzr S2两大工业人形机器人从早9点到晚5点全程在岗、自主作业、稳定干活。

优必选全新发布的全尺寸商用服务人形机器人Walker C1,能在商超、展馆、综合体进行迎宾导览、文娱展演、客流互动等。

还有家庭消费场景,今年6月优必选刚发的超仿生人形机器人优世界U1,是全球首款可实现规模化量产的超仿生人形机器人,能用于情绪支持、养老陪伴、迎宾接待、文旅展览、心理关怀等民生与商用场景。

可以看到,在全栈具身智能大脑的加持之下,优必选的人形机器人早已不再是只会执行指令的机器人,而是真正长出了能干活、能交互、能共情的能力。
这套体系让我们在WRC现场看到了一套可落地、可复制、可规模化的产业能力,为整个人形机器人行业的商业化、产业化发展提供了成熟范本。
三、具身智能产业进入深水区,生态能力是关键胜负手
人形机器人是横跨算力、芯片、硬件、算法、制造、场景的超级复合赛道,单一企业的技术与产能无法支撑整个产业的规模化普及,因此其需要翻越的难关很多。
正如前文所述,数据正是这套系统工程当中非常难啃的一块硬骨头。高质量具身场景数据稀缺、采集标注成本居高不下,已经成为横亘在通用人形机器人前进道路上一道绕不开的高墙。
数据瓶颈之外,焦继超坦言,当前市面上绝大多数具身模型均以Transformer架构为基础,但这套源自大语言模型的技术框架,并非为机器人感知运动协同的具身特性量身打造。为此,优必选也已开启面向具身原生的模型架构创新探索,试图从底层框架上找到破局方向。
除软件算法层的难题以外,硬件侧的短板同样掣肘着人形机器人产业化落地,例如电池续航、轻量化材料、机器人专用算力芯片等。
正因如此,焦继超提到优必选一直在构建生态链。
优必选在底层算力赛道与沐曦股份合资成立“曦选创智”布局具身智能端侧芯片研发与量产,在关键零部件上其子公司锋龙股份将聚焦灵巧手、伺服驱动器等研发与制造,还有和智能制造、汽车、物流等赛道头部企业合作探索。
当下人形机器人产业已经迈入商业化落地的关键窗口期,算力自主可控、供应链安全稳定、场景快速泛化、产业开放协同所构筑起来的生态优势,终将成为头部玩家赖以长期领跑的终极护城河。
结语:全链路布局,优必选开启通用具身智能产业新周期
当前机器人行业正告别早期参数竞赛、样机演示的粗放发展阶段,正式进入落地为王的产业化深水区,全栈自研、场景适配、数据迭代、生态协同的综合体系能力,成为评判机器人竞争优势的核心标尺。
优必选深耕具身智能十余年,已经完成了从底层模型、端侧工程、虚实数据的技术闭环,到工业、商用、家庭全场景的实战落地,再到算力、供应链、产业伙伴的生态共建,率先跑通了行业商业化与产业化的完整路径。
热门资讯
猜你喜欢
——工业智能全场景解决方案专家








