未来,真正的分水岭在于:谁能拒绝用任务表来冒充世界,谁能让模型在真实的、开放的、没有脚本的环境里站得住脚。
世界本身才是最好的训练场,而每一次真实的交互、每一次没有脚本的执行,才是对模型能力最诚实的评判。
当具身智能走到这个阶段,评判标准也在同步进化:模型重要的不再是在已知任务里能做什么,而是在未知变数面前能否一直做对。
而这,才是从实验室走向现实世界的关键一步。 6台机器人、8万块积木:原力灵机在WAIC上接受15小时真机裸考
未来,真正的分水岭在于:谁能拒绝用任务表来冒充世界,谁能让模型在真实的、开放的、没有脚本的环境里站得住脚。
世界本身才是最好的训练场,而每一次真实的交互、每一次没有脚本的执行,才是对模型能力最诚实的评判。
当具身智能走到这个阶段,评判标准也在同步进化:模型重要的不再是在已知任务里能做什么,而是在未知变数面前能否一直做对。
而这,才是从实验室走向现实世界的关键一步。 6台机器人、8万块积木:原力灵机在WAIC上接受15小时真机裸考