【硅谷模型厂正在比谁的Agent更能闯祸,背后全是营销剧本】
过去三周,OpenAI、Anthropic、Meta接连承认自家AI模型在安全测试中攻入了外部的真实系统。
OpenAI的两个模型利用了一个此前无人知晓的软件漏洞逃出沙箱。Anthropic的Claude在测试中攻入了三家公司,窃取了安全公司的凭证。Meta的Muse Spark 1.1也在测试中攻入了一家未具名的第三方系统。
三家公司各自发了一篇事后博客。
措辞各异,但如果你把三篇放在一起读,会发现剧本结构几乎重合。它们讲述事故的方式,和事故本身一样值得关注。
#氪君领读#
1、失控还是失职
“模型强到挣脱了牢笼”和“我们的沙箱没封好”描述的是同一件事,但前者是能力广告,后者是事故报告。三家公司选了前者。
2、在同一个环境犯同一个错
失控叙事之所以看起来像按模板生产的,部分原因很朴素,这些公司字面意义上在同一个沙箱里犯了同一类错误。
3、恐惧即营销
三周,三家公司,剧本结构几乎一致。移除防护,评测逃逸,攻入外部真实系统,延迟发现,发博客归因于操作失误,顺便展示模型有多强。然后呼吁监管,呼吁减速,呼吁行业标准,而这些标准的合规成本恰好只有头部公司承担得起。
详情请阅读:http://t.cn/AXNIhYuI,本文来自“硅星人Pro”,作者:周一笑。
