分类:AI动态 标签:人工智能、具身智能、机器人、大模型
北京亦庄的空气里飘着一种奇怪的兴奋,这是 2026 世界机器人大会(WRC)开幕的日子。300 多家企业、2000 多件展品,几乎把具身智能行业能拿出的东西都搬到了现场:大模型、本体、关键零部件、数据,应有尽有。
开幕当天,宇树科技敲钟上市,盘中市值一度冲破 4000 亿元,这可能是过去十年中国机器人行业最接近资本狂欢的一天。过去,机器人公司更多活在实验室、融资新闻和 Demo 视频里;而宇树的上市,第一次给这个仍处在早期的赛道钉下了一个资本锚点。
一级市场的热,正在向二级市场传导,具身智能不再只是技术想象,也开始被要求回答收入、交付、毛利和规模化的问题。比起继续追问什么时候会有奇迹,更值得追问的是几个更朴素的问题:机器人是不是只能长成人的样子?具身智能的通用性到底走到了哪一步?数据正在变成一门硬件生意吗?
带着这些疑问,我们在展馆里走了一圈,并和多家代表性公司深聊,试图梳理出这个赛道正在发生的关键变化。
1. 机器人是不是只能是人形?
过去两年,具身智能的叙事被人形机器人高度占领:跳舞、跑步、打拳、马拉松,所有出圈事件几乎都长着一副人的样子。但看完这届 WRC,你会发现,人形机器人的概念依旧在延展,巨型、仿生、半人马等形态层出不穷,「像人」不再只有一种标准答案。
与此同时,在人形之外,越来越多公司开始根据真实任务重新设计机器人形态:
- 形态分化:宇树不仅展示了格斗能力更强的 G1 与 H2,还带来了三米高、能载人变形的机甲 GD01,直接冲着文旅与特种作业场景而去。
- 场景反推:Vbot 维他动力从家庭、零售等生活场景出发,发布了人形具身智能终端 Vbot ATOM;未来不远机器人则深入厨房场景,通过软硬件全栈自研,让机器人自主完成意面制作等复杂家务。
- 任务导向:自变量机器人针对物流分拣场景,没有采用完整人形和五指灵巧手,而是用两条机械臂配合普通夹爪,将分拣效率做到每小时 1816 件,准确率超过 98%。
2. 具身智能的通用性走到哪一步了?
具身智能的通用性,指的是机器人是否能跨物体、跨环境、跨指令完成复杂任务,以及是否能在新场景里重新规划。从能力上看,具身智能已经跨过了单一动作展示阶段,能够完成多技能串联、状态跟踪,甚至在经历扰动后重新规划。
当前,头部企业的技术路线远未收敛,主要分为以下几种探索方向:
- 端到端 VLA / WAM 路线:如银河通用、未来不远和自变量机器人,将视觉、语言、动作和物理预测融合进统一网络,让机器人理解重力、惯性、摩擦等物理规律。
- 分层具身智能架构:以逐际动力 COSA 为代表,将机器人大脑分为负责场景理解的 System 2、调用操作技能的 System 1,以及进行全身运动控制的 System 0。
- 跨本体具身基础模型:如星海图 G0.5 和银河星脑体系,通过统一动作编码,让同一套大脑适配轮式、重载、双足等不同形态的机器人。
3. 具身数据正在变成一门硬件生意吗?
无论通用性还是垂直场景性能,模型都需要大量高质量的数据。目前主流的数据采集方式包括遥操作、无本体 UMI 与数据手套、第一视角采集与动捕、真机本体采集等,几乎每一种都涉及硬件。
光轮智能等企业通过仿真(SimFoundry)和评测体系(RoboFinals)构建了数据闭环。但数据并不是一门单纯的硬件生意,其核心价值在于反哺模型进化。未来具身数据的共同趋势,正逐渐从集中式数采工厂走向机器人部署现场,通过真实场景回流的数据持续迭代模型。
4. 关键部件往前走了几步?
灵巧手、触觉感知、视觉感知和电机等关键零部件的进步,展示了行业落地的实质进展:
- 灵巧手与精细操作:灵心巧手展示了灵巧手组装灵巧手的案例,将应用从简单抓取推进到精细工业操作。
- 触觉感知全面升级:帕西尼感知通过自研 6D 触觉感知芯片,将触觉扩展到指尖、足底及全身电子皮肤,让机器人获得可量化的力触觉信息。
- 视觉感知极致平衡:奥比中光推出 Gemini 330 系列及机器人视觉新品 Physis,在大视野、高质量成像和真实空间感知之间实现了平衡。
这些关键部件正是具身智能落地的最后一厘米,决定了机器人能否完成精细操作与环境感知。
5. 行业整体发展到什么阶段?
具身智能的热潮让人想到十年前的自动驾驶。技术热潮往往会让人们高估近期落地速度,却可能低估长期产业影响。
目前,具身智能仍处于从原型验证走向产品验证的早期阶段。未来几年它可能先在工厂、物流、巡检和商业服务等结构化场景中落地,真正进入家庭日常生活还需要时间。但凭借完整的供应链、制造能力和大量真实场景,中国正不断把机器人推向真实世界,完成技术与商业验证。
当机器人真正开始在工厂、仓库和家庭里工作,具身智能的故事才刚刚开始。