量子位
25-09-11 13:19 微博认证:量子位官方微博

#李飞飞谈LLM局限性##李飞飞一年前观点火了#

大语言模型的局限在哪里?AI教母李飞飞这样说:

“大自然中是没有语言存在的”,语言只是人类生成的信号。而物理世界是客观存在的,因此,语言模型本质上是人类加工的产物,无法独立理解现实。

她指出,多模态语言模型虽然能处理图像,但最终仍是将图像等内容塞进一维token中处理。这种方式在处理空间智能——即理解三维世界的任务时,天然就有劣势。因为3D世界有物理结构、材质、规则,而语言是人造的,无法完全覆盖这些内容。

有研究团队就做了实测:拿AI环境测试Claude 3.5、GPT-4o、Gemini 1.5 Pro在虚拟3D世界的表现,结果是只会简单任务,难一点就失败。哪怕加入教学示范,表现也没变好。

这表明,在理解三维的物理世界方面,大模型的表现明显落后。

还有团队设计ABench-Physics测试,结果最强模型正确率只有43%,换个数字同理题后更差。再到视觉任务中,人类正确率95%,模型最高只有51%。这些实验都反映了李飞飞的观点——语言模型理解物理世界确实有限。

当然,也有反方声音。有网友认为语言模型可以发展出自己的“语言”理解方式;也有人说,语言在某些情况下比感知更有优势。

无论怎样,AI在理解现实世界这件事上,科学家们正不断探索可行方式。
http://t.cn/AXhPf1Xf http://t.cn/AXPDMp2z