行星矿工
25-02-04 15:25 微博认证:科学科普博主

话说,突然在和朋友的讨论中,对于为什么目前的AI大模型普遍都有“幻觉”这件事突然有了个比较清晰的想法——这恰恰说明大模型和人脑的思考方式是几乎一样的

心理学早已证明,人脑的记忆模式从来都不是电脑那种一个字节都不能错的放照片或录视频式的记忆,而是主要记录每件重要事情的梗概特征,至于不那么重要的细节靠脑补就可以了,用心理学术语说,这叫基于记忆中存储知识的重新整合(integration)和组织(organization)

所以人的记忆也是时间越近、越熟悉的领域越准确,时间越远、越不熟悉的领域越不准。因为关键梗概没记住或者有错漏,只能靠与之关联领域的知识来推测,说难听点就是现编。

这也是为什么法庭审判这种严肃场合从来不会过度认可人的回忆,而必须靠物证或者照片录像,因为回忆普遍是很不准的,尤其是在各种有意的引导下,甚至可能每次编出来的结果都不一样,这已经被证明无数次了(比如说心理学一个著名的实验,先给被试看一个撞车录像,完后法官问被试,看到两车“接触”还是两车“相撞”,再让被试揣测下撞车速度,两组人给的速度会差很多)。

大模型本质上是模拟人的思考方式,同时大模型又学习了人类几乎所有的知识,毫无疑问,只靠那几百个G的容量(deepseek-R1的671B完整版模型也就只有404GB)肯定是远远不够的,所以大模型对很多事实的掌握和分析也应该和人脑一样,只记最重要的梗概和要点,不知道的细节到时候靠其他领域的知识现编

既然是现编,就肯定会有编错了的东西,这就叫做“幻觉”[思考]

#deepseek彻底爆发#

发布于 北京