中国国家数据局表示,将制定具身智能数据标准,并指导地方政府开展相关工作。此举距离七家企业向其提出这一诉求仅过去十天。欧洲虽然监管谁可以获取机器生成的数据,但并没有生产这些数据的项目,而其《数据联盟战略》中承诺设立的数据实验室也尚未建立。
中国数据监管机构将为训练机器人的数据制定标准。据《国家数据管理局》报道,该机构表示将指导地方政府开展这项工作,并支持企业加大对数据资源的投入。
这一声明是在9月10日由该局局长刘烈宏主持的会议之后发布的。研究机构、科技公司和人形机器人组织出席了会议,该局表示,该行业正变得越来越以数据驱动。
产业界先提出了需求。据MLex报道,十天前,同一家机构与七家公司进行了会面,这些公司请求为具身智能提供公共数据基础设施以及通用的数据标准。人形机器人领域的制约因素已不再是模型本身,而是数以小时计的真实世界记录数据。
据中国信息通信研究院估算,具身智能基础模型大约需要1000万小时的真实训练数据。而全球现有高质量数据大约在10万至100万小时之间。中国正在构建这一供给。
据TechNode报道,中国已有70多个具身智能训练场投入运营,分布于全国半数以上的省级地区,另有46个正在规划或建设中。其中约86%的训练场面向工业制造领域。这三个集群分别是长江三角洲、京津冀地区和珠江三角洲。
欧洲在几乎没有收集多少这类数据的情况下,已为其制定了规则。《数据法案》自2025年9月12日起适用,规定了谁可以获取联网产品生成的数据,其中包括工业机械。
它还阻止这些数据被用于制造竞品。设计义务对2026年9月12日之后投放欧盟市场的联网产品具有约束力。
欧洲最接近中国训练场的对应物是一家公司。NEURA Robotics正在建设训练场:计划建设十座,其中五座预计在今年年底前投入运行,分布在欧洲、美国和中国。
欧盟委员会于2025年11月19日发布了一项“数据联盟战略”,其首要任务是扩大人工智能对数据的获取。十个月过去了,其中大部分行动尚未落实,包括数据实验室。
这一切都不会把市场拱手让给中国。今年接受调查的中国企业中,仅有23%对市面上可用的机器人表示满意,而一个训练场收集的是工时,而非付费客户。