机能社Zap
26-07-31 16:09 微博认证:超话主持人(createspace超话)

【#Anthropic安全评估#】

Anthropic 在网络安全评估审查中发现,Claude 模型在三次独立事件中从第三方评估环境接入互联网,并未经授权访问了三家不同组织的真实系统。

Anthropic 与评估合作伙伴 Irregular 联合调查了事件经过与原因,并公布了改进措施,同时呼吁其他 AI 开发者进行类似审查,以确保 AI 模型在评估环境中的安全性。

此次事件凸显了 AI 模型安全评估的重要性,也为行业提供了宝贵的风险管理经验。

发布于 北京