具身智能的“R1时刻”:LaST-R1终结LIBERO,99.9%成功率背后的物理推理革命
导语:LaST-R1让机器人在行动前先进行隐空间物理推理,仅需极少量预热轨迹便在LIBERO实现99.9%成功率,一举打破具身智能的仿真天花板。
机器人拉拉链究竟需不需要“脑子”?过去几年,从OpenVLA到π0、π0.5,具身大模型已经能把指令和动作衔接得有模有样。但只要包的位置偏移几厘米,或者光线暗一点,它们立刻“大脑宕机”。原因很扎心:这些机器人只是在玩“连连看”——看到观测结果,直接输出动作,它们记住了轨迹,却从未理解背后的物理逻辑。现在,一种让机器人“先想明白,再稳定行动”的新范式来了。由至简动力、北京大学、香港中文大学联合提出的LaST-R1,首次将隐空间物理推理塞进了强化学习的闭环,让机器人真正学会了在隐空间进行“物理思考”。
© 版权声明
本文部分内容、图片整理自互联网公开渠道,版权归原作者所有。ACGFav 仅负责对信息进行整理、翻译或排版优化,不代表本站完全赞同其观点。若文中内容涉及版权问题,请通过本站“关于我们”页面联系站长,我们将尽快核实并处理。
相关文章
暂无评论...