#互联网人物# 王鹤对具身机器人发展的理解
王鹤指出:具身智能的核心是泛化能力,他认为,当前具身智能仍处于发展初期,提高泛化性和通用性是人形机器人面临的最大挑战。目前人形机器人在运动能力展示方面存在“炫技”现象,但这些动作大多缺乏真正的智能,未来需要发展手眼脑协调能力,以推进人形机器人在实际场景中的应用。
王鹤提出,三维视觉小模型与基础大模型的结合是实现具身智能的一条有效路径。他认为,谷歌的RT-2和Figure给出的方案并非最优解,而三维视觉小模型可以更好地与基础大模型结合,实现具身智能。
王鹤指出,当前的大语言模型主要依赖互联网上的文字和图像数据,但这远不能覆盖人类婴儿成长过程中所接触的真实、多模态感知信息。婴儿通过主动探索和多感官交互来理解世界,其学习效率早已超越当前的视觉-语言大模型。#智能机器人# #微博兴趣创作计划# http://t.cn/A6gRjDg1
发布于 山西
