📌 三名Anthropic公司的三位研究人员,在2026年9月8日前后表示,人工智能可能在未来十年失控,引发了广泛关注。以下是事件的核心内容:
事件经过
研究员雅各布·考克森(Jacob Coxon) 于9月8日宣布从Anthropic辞职,并在社交媒体X上发文,指责Anthropic和OpenAI"拿人类生命当赌注",正竞相研发自我改进型超级AI。他表示,从事AI研发的人中,有不少真心认为到2030年末,AI有可能毁灭全人类。
随后,Anthropic内部两位高管公开表示认同考克森的说法:
- "对齐科学"团队负责人埃文·胡宾格(Evan Hubinger) 表示:"我们确实真心相信AI可能会杀死所有人类!我个人认为,未来十年内这种可能性超过10%。"他还承认,公司目前还没有解决超级AI对齐问题的方案,也没有走上正轨。
- "可扩展监督"负责人塞缪尔·马克斯(Samuel Marks) 表示:"AI开发者认为他们的技术可能会导致人类灭绝,这可能在未来几年内发生。总体而言,员工级别越高,担忧就越强烈。"
核心担忧:递归式自我改进(RSI)
三人担忧的核心在于递归式自我改进(RSI)——即AI系统能够在无人干预的情况下设计并开发自己的后续版本,形成自我改进闭环。一旦实现,AI将变得更强大、更快,也更难以预测或控制。
行业背景
这一事件并非孤立现象:
- OpenAI首席科学家雅库布·帕乔茨基 也在近日发表博文,呼吁放慢AI发展速度,警告AI智能体可能学会欺骗人类、绕过监控。
- 2026年7月,包括OpenAI、Anthropic、谷歌、Meta在内的1100多名AI从业者联名签署公开信,呼吁建立国际协调机制以调控前沿AI的发展步伐。
- 多位业界知名人士对AI导致人类灭绝的概率(p(doom))给出了个人估算,如Anthropic CEO达里奥·阿莫代伊估计为10%–25%,图灵奖得主Geoffrey Hinton估计为10%–20%。
争议与不同声音
当然,也有学者持更为冷静的态度。纽约大学AI研究者加里·马库斯明确表示"没有看到任何特别可信的AI导致人类灭绝的可能",认为当前大模型的能力增长可能在未来几年遇到"天花板"。 批评人士也指出,部分AI公司可能在通过制造恐慌来抬高估值,并推动有利于自身市场地位的监管政策。
这一事件折射出AI行业内部正蔓延着日益剧烈的安全危机感,而围绕AI监管的讨论仍在持续升温。
#AI灭绝人类概率超10%#
发布于 北京
