向度之桥
26-06-05 16:34 微博认证:科技博主

Anthropic昨天(6月4日)发了一份报告,标题是"递归自我改进"(Recursive Self-Improvement)。
里面有一句话:世界应该有一个减缓或暂时暂停前沿AI研发的选项,让对齐研究(AI安全领域研究怎么让AI跟人类目标一致)和社会制度跟上。
Anthropic提议美国、中国等主要AI公司应该达成共识,做"AI版核不扩散条约"。

但同一份文档里,Anthropic还公布了一组内部数据。这组数据跟他们的呼吁是相反的。

1️⃣ Anthropic自己,80%的代码是Claude写的
报告里最炸的一组数据,来自Anthropic内部。
到2026年5月,Anthropic自己合并进代码库的代码,80%以上是Claude写的。
(原文位置:"as of May 2026, more than 80% of the code we merge into Anthropic's codebase was authored by Claude")。
2025年2月Claude Code上线之前,这个比例是个位数。半年时间,从个位数到80%。

还有别的数据:
• 每个工程师每天合并的代码量,是2024年的8倍
• Mythos Preview(Anthropic下一代旗舰模型,Claude Opus 4.7的后继)能持续工作至少16小时
• 代码优化任务上,Mythos Preview比Claude Opus 4快52倍(人类研究员需要4-8小时才能做到4倍)
• Anthropic让Agent自主跑一个AI安全研究项目,Agent在800小时算力+$18000成本里,完成了97%的目标差距;两个人类研究员一周才完成23%

这些数据是Anthropic自己列在同一份文档里的。他们在告诉世界:AI自己开发AI这件事,已经发生在我们公司内部。
不是未来,是过去半年。

2️⃣ 他们呼吁"全球暂停",但他们自己承认这做不到
读到这里有个矛盾:既然AI自我改进的能力已经在Anthropic内部实现了,他们呼吁"全球暂停",是希望自己也暂停吗?
报告里有一段话回答了这个问题:
"如果一次暂停只是让最不谨慎的玩家追上来,可能会让所有人更不安全。没有全球协调机制,公司和政府将在竞争和地缘政治压力下,对安全问题做艰难决定。"
翻译过来:单方面暂停没意义,只有大家一起暂停才行。
但报告下一段就把这个方案否了:AI训练比导弹更难监控。

原文是这么说的:训练运行比导弹井更容易隐藏(training runs are far easier to conceal than missile silos),输入是通用的(算力、数据),偷偷继续训的诱惑巨大,因为谁不停谁就成为领跑者(whoever continues while others pause could inherit the lead)。

意思是:即使所有人都同意暂停,也没有任何技术手段能验证别人真的停了。

那这个"全球暂停"具体怎么执行?
Anthropic自己也答不上来。他们用了一个比喻:中程核力量条约(美苏 1987 年签的限制中程导弹的条约,1991 年正式生效)。但他们也承认,这种条约花了几十年才建立,而"我们没那么多时间"(we don't have that long)。

所以Anthropic实际上在说:我们应该有一个全球暂停机制。但他们自己已经把这个机制怎么做不出来给论证完了——验证不了,时间也来不及

3️⃣ 如果暂停做不到,他们到底在喊给谁听?
所以问题来了。
一家估值近2000亿美金的AI公司,商业模式就是训前沿模型。他们呼吁的事——全球协调暂停——按他们自己的分析就做不到。但呼吁本身是有用的。
对谁有用?
第一,对监管者。
这份报告等于是Anthropic给政策制定者递了一份现成的话术:Anthropic都说要暂停了,所以我们(政策制定者)必须出手监管。

第二,对小公司。
前沿AI监管的成本极高(合规、安全审计、对齐研究),小公司根本承担不起。一旦监管落地,真正被压死的不是Anthropic,是想做下一个Anthropic的人。

第三,对国际舆论。
报告提到中国实验室(DeepSeek、Qwen、智谱等头部中国AI公司)应该一起参与暂停。但中国实验室还在追赶,暂停对追赶者最不利。
Anthropic这个提议的潜台词是:美国领跑者希望中国停下来等等。

把这三条放在一起看,这份报告的真实效果是给Anthropic自己造护城河。监管会跟着这种声音走,中国会承受这种舆论压力,而Anthropic自己留下了道德高地——它呼吁过暂停,所以以后无论 AI 出什么事,锅都不在它头上。

但它其实知道,真的全球暂停不可能发生。
所以一份报告里,他们一边公布内部数据证明AI自我改进已经实现,一边呼吁全球暂停。前一半给客户看,后一半给监管看。

看完这事,我最大的感受是:当一家公司既是行动者又是规则制定者,你不能只看他说什么,要看他做什么。

Anthropic在做的事是:训更强的模型(Mythos),让Claude写更多自己的代码(80%),让Agent自主跑研究(97%)。
Anthropic在说的话是:大家应该暂停。

这两件事并行。你信什么?

我之前写过教皇通谕那篇,讲的是让犯人定义凶器。
Anthropic这事跟让烟厂老板牵头起草控烟法没啥大区别。

发布于 上海