【对话罗剑岚:机器人必须在真实世界中持续变强】
采访过半的时候,我们问罗剑岚:从最早做真机#强化学习# 到现在,已经十多年了,这中间有没有哪段失败经历,让你对这个方向产生过怀疑?
他几乎没有停顿:“每天都在失败。经常失败,有时又会觉得有希望。”
“但从来没有怀疑过?”
“那倒也不是,也会怀疑吧,也觉得可能会成功。但我到今天都没觉得我很成功,因为最终的目标还没达到。”
这个“最终的目标”,他在一个小时的访谈里反复回到同一句话上:机器人不能只在静态数据集上学会模仿,它必须知道自己执行一个动作之后会发生什么。在他看来,强化学习、世界模型、VLA,全都只是服务这个命题的工具。
罗剑岚是上海创智学院副教授、智元机器人首席科学家。他博士毕业于加州大学伯克利分校,先后在 Google 和伯克利人工智能实验室担任研究员和博士后, 曾获 ICRA Best Paper、《麻省理工科技评论》“35 岁以下#创新35人# ”(TR35)中国区等奖项。
戳链接查看详情:http://t.cn/AXSx8XFF
