具身智能的“R1时刻”:LaST-R1终结LIBERO,99.9%成功率背后的物理推理革命

导语:LaST-R1让机器人在行动前先进行隐空间物理推理,仅需极少量预热轨迹便在LIBERO实现99.9%成功率,一举打破具身智能的仿真天花板。

机器人拉拉链究竟需不需要“脑子”?过去几年,从OpenVLA到π0、π0.5,具身大模型已经能把指令和动作衔接得有模有样。但只要包的位置偏移几厘米,或者光线暗一点,它们立刻“大脑宕机”。原因很扎心:这些机器人只是在玩“连连看”——看到观测结果,直接输出动作,它们记住了轨迹,却从未理解背后的物理逻辑。现在,一种让机器人“先想明白,再稳定行动”的新范式来了。由至简动力、北京大学、香港中文大学联合提出的LaST-R1,首次将隐空间物理推理塞进了强化学习的闭环,让机器人真正学会了在隐空间进行“物理思考”。

© 版权声明

相关文章

暂无评论

none
暂无评论...