欧洲的物理 AI:一张地图,和缺失的那一层

欧洲对物理 AI 的押注是真实的,且资金充裕。但硬件与算力可以自由流动,真正搬不走的输入,是具备欧盟司法管辖权的示范数据。

阅读约 6 分钟

去问一位欧洲机器人创业者,这块大陆能不能在物理 AI 上胜出,你往往会换来一个疲惫的眼神。同样的问题,曾被用来问搜索、问社交网络、问云、问大语言模型。每一次,欧洲都出钱做了研究,然后眼看着产品从加州和深圳出货。

这一波也许会不一样,原因是钱。从 2025 年到 2026 年,欧洲的人形机器人与物理 AI 公司完成了几轮融资,放在几年前,对一家硬件创业公司而言几乎是不可想象的。老牌工业巨头也开始把人形机器人试点搬上了工厂产线。资本和客户,这一次难得地处在同一个时区。

所以真正诚实的问题,不是欧洲在不在这场竞赛里。它在。更尖锐的问题是:欧洲具体能长期握住什么。多数报道按机器人或按模型来画这张地图,本文则按另一条悄悄决定其余一切的轴线来画:每一个玩家的训练数据,究竟从哪里来。

欧洲的版图,比头条显示的要拥挤

先看那个最响的数字。The Robot Report 报道了德国人形机器人公司 NEURA Robotics 宣布的一轮融资,据报道量级在 $1.4B 上下,是欧洲机器人公司有史以来最大的融资之一。NEURA 还把它与慕尼黑工业大学合建的训练中心 RoboGym,称作欧洲最大的物理 AI 训练中心。这两个数字都来自 NEURA 及其报道,而非独立审计,但那份野心是真实的,而且资金充裕。

头条之下,坐着的是工业界的支持者。德国及更广泛的欧洲制造商,已经在真实产线上跑过人形机器人试点;零部件巨头也入股了人形创业公司,比如轴承厂商 Schaeffler 就下注了这个赛道。International Federation of Robotics 长期记录着:欧洲的工业机器人装机量本就庞大,背后是一条很深的自动化供应链。这个格局很眼熟:研究强、制造强,却在「实验室结果变成出货产品」的那一步上,始终有一道缺口。这块大陆不是从零开始,它是从一座工厂开始。

护城河不是机器人,也不是 GPU

对任何只押硬件的人来说,接下来这点会让人不安:机器人正在趋同。把 Figure、1X、Agility、Boston Dynamics 和 NEURA 摆在一起看,你会看到大体相同的配方:一台双足或轮式人形,一双灵巧手,几十个执行器,一个传感头。领先者之间的机械差距在缩小,而不是拉大。

模型也在趋同。当下严肃的具身控制工作,大多在训练某种形态的视觉·语言·动作(VLA)模型,而这些配方越来越多地公开发表。NVIDIA 的 Isaac GR00T 就开放了一个人形基础模型及其周边工具链。IEEE Spectrum 的报道,追踪着这些架构在实验室之间扩散得有多快:一篇机器人学习论文里的好点子,几个月内就能在十几个地方跑起来。

算力也是同一个故事。GPU 是买来的,不是与生俱来的;你在法兰克福能租到的加速器,和一家实验室在弗里蒙特租到的是同一批。这三样输入,硬件、模型、算力,没有一样是留得住的,每一样都能凭一张采购单跨过国界。

硬件在趋同,模型在共享,算力则是租来的。唯一无法在你需要时跨境搬走的输入,是一份合法的、真实人手执行真实工作的记录。

每个玩家的数据,究竟从哪里来

最后那样输入才是有意思的,因为它并不像文本那样能够扩展。没有谁预先攒下一大批同步好的头戴相机、力和手部姿态记录,摆在那里等人抓取。每一支严肃的团队,都得想办法弄到示范数据,而它选择的方法,决定了下游一切的成本、速度和法律根基。

主流路线各自如何获取机器人示范数据,以及各自会撞上的约束
路线主要数据来源代价供给由谁掌控
仿真与合成物理引擎、生成的轨迹接触密集任务上的仿真到现实鸿沟谁拥有仿真器
遥操作机队操作员牵引机器人慢、贵,一次只能一种本体机器人公司
汇聚的学术语料Open X-Embodiment、DROID、RH20T规模小、异构、授权不一共享,无单一所有者
公开的第一人称视频Ego4D、Ego-Exo4D为感知而建,力与动作标签稀薄研究联盟
专门采集的人类示范佩戴仪器的人执行任务必须刻意采集,代价不菲采集方及其司法管辖区

顺着最右一列往下读。多数行里,供给都掌握在一家美国或中国的机器人公司、一家全球仿真厂商,或一个松散的研究联盟手里。那些汇聚的数据集确实有价值,Open X-Embodiment 和 DROID 都在其中,但放在一个基础模型的胃口面前它们还很小,而且授权状况参差不齐。最后一行,是唯一一行里司法管辖是一个设计选择,而不是「数据碰巧在哪儿被记录下来」的偶然。

欧洲的优势在司法管辖,而不只在工程

正是在这里,地图开始向欧洲倾斜。如果稀缺的输入是一份真实的人执行真实任务的记录,那么这份记录就是个人数据,采自人的身体、面孔、住所与工作场所。你可以如何采集、如何记录、如何出售它,这不是一个技术问题,而是一个法律问题,而欧洲早已把法律写好了。

EU AI Act 正在分阶段引入围绕数据治理、文档与溯源的义务,而 GDPR 早已管辖个人数据的同意问题。对一家美国或中国的数据业务而言,这些规则读起来像摩擦;对一家欧洲的业务而言,它们读起来像一份规格书。在欧盟境内、带着知情同意和一条有据可查的溯源链去采集示范数据,你就产出了一个受监管市场里的买家真正能够辩护的东西:这个品类开始称之为主权机器人数据(sovereign robot data),或具备欧盟司法管辖权的示范数据。

公司架构和相机同样重要。一份由欧盟注册主体持有、按公司架构归于欧盟司法管辖的数据集,在面对外国披露要求时,与同一份数据放在一家美国所有的云上相比,是被隔离保护的。对一家必须向监管者、审计师或职工委员会解释其训练数据的 OEM 来说,溯源不再是文书工作,而变成了一个购买的理由。

所以,欧洲物理 AI 的地图,其实并不是一张关于机器人或模型的地图。它们正在收敛向一条共享的全球基线,没有哪一面旗帜能独占它们。真正能承载一个司法管辖区的,是数据:由谁采集、在何种同意之下采集、以及哪个法院管辖持有它的那个主体。这,就是大多数领域地图上缺失的那一层,而本系列接下来会顺着它往下走:走进第一人称数据如何在欧洲被采集,走进 CLOUD Act 对机器人数据意味着什么,以及为什么溯源正在变成一个你可以出售的特性。

physical-aieuropedata-sovereigntyembodied-aitrends

来源