关于ZAKER Skills 合作
手机中国 07-23

昆仑万维董事长方汉谈世界模型:核心瓶颈在数据量级

【CNMO 科技消息】据 21 财经消息,在世界人工智能大会期间的一场媒体沟通会上,昆仑万维董事长兼 CEO 方汉就世界模型的数据成本、行业竞争格局、内容行业门槛变化等话题分享了自己的判断。

图源网络

方汉认为,具身智能世界模型能否迎来类似 ChatGPT 的突破性时刻,关键在于能否获取足够多的训练数据,门槛大约是 1000 万小时,再往上则是 1 亿小时。

他算了一笔具体的成本账,手套这类采集硬件原来的成本都在十几万元,今年才降到一万多元,而单位小时的 UMI 数据和真机数据采集成本原来最低约 500 元,贵的能达到一两千元。按此换算,1000 万小时真机数据至少需要 50 亿元,1 亿小时则需要 500 亿元。方汉直言,这个成本谁都扛不住,没有一家公司能负担得起这笔费用。

正因如此,方汉判断异构数据将取代真机数据,成为预训练的主要来源。他提到,用手机、胸挂摄像头拍摄的人手操作数据目前采购成本不到 50 元,销售价约在 50 元左右,并预测今年到明年能降到 10 元一小时,这样 1000 万小时可能只要 1 亿元。

他还透露,昆仑万维自有的 Riemann-1.0 模型在加入大量异构数据后,即使是叠衣服这类原本认为只靠真机数据就够的任务,完成效果也出现了明显提升,使得 Riemann-1.0 在 RoboCasa 365 这个特别复杂的任务上能够比之前的方法高出 8 个百分点。

被问及哪家公司更有可能率先达到 1000 万小时数据量级时,方汉表示大家都有可能,关键看融资能力。但他同时强调,数据采集设备的生产将集中在中国,因为中国是数据采集硬件的产地,同时拥有全世界最全的工业门类以及人口规模带来的家政和快递服务业数据优势。

据此预测,到今年底应该没有厂商能达到千万小时,但应该有厂商能达到百万小时,明年底可能有厂商能达到千万小时,而亿小时级别则需 3 到 5 年之后。

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容