灵初智能最近这事挺有意思。四月开源首批1000小时人类手部数据,年底又喊着冲100万小时积累。两件事放一块看,像在下一盘数据双轨制的棋。
开源那1000小时,说是抛砖不夸张。具身智能现在最缺的不是模型,是统一的动作表征格式——你开源数据用的什么坐标系、什么标注规范,别人跟着用,慢慢就成了行业默认标准。标准捏在谁手里,生态定义权就是谁的。开源引流、闭源筑墙,这套互联网圈早玩透了。
真正值钱的是闭着不说的百万小时。能训出通用操作能力的长尾数据,不规则物体抓取、多步任务衔接,握在自己手里才是护城河。竞品抄得到你开源的砖,抄不到你藏着的玉。嗯
年底冲百万小时也耐人寻味。现在就是数据规模的军备竞赛,谁先跨过"通用"那条临界线,谁大概率就定义了下一代机器人能力的上限。