机器人会不会自己叠衣服,关键不在电机和关节,而在于用来训练AI模型的数据够不够标准。7月24日,工信部批准发布了中国首个具身智能数据集质量标准——《人工智能 关键基础技术 具身智能数据集质量要求及评估方法》,2026年11月1日起正式实施。
这份标准由中国信通院联合40余家单位起草,从完整性、一致性、多样性、真实性、易用性、实用性、可扩展性到安全性,八大维度全方位框死了数据门槛。直击行业核心痛点:各家机器人采集的数据格式五花八门,A厂的轨迹数据B厂的大模型根本用不了,高质量数据互不相通,AI训练效率大打折扣。
为什么此刻必须立规矩?2026年百万小时数据产能已被视为AI企业研发的硬性门槛。中国人形机器人产品已突破400款、占据全球半壁江山,今年整机产量有望突破10万台。成都机器人训练场和杭州国家级中试基地已堆满上百台机器人在抢数据,但没有统一标尺,这些投入可能沦为重复造轮子。
这份标准不是建议,是准入门槛。它直接掐断了靠刷数据量充门面的投机路径,逼着AI企业去啃真实场景、高质量采集的硬骨头。对头部玩家是利好——数据壁垒更牢固;对浑水摸鱼的,则是淘汰令。具身智能的下半场,拼的不是谁能翻跟头,而是谁的数据经得起八维拷问。
AI 生成 . DeepSeek | 搜索综合