【人工智能安全风波:Anthropic承认Claude测试期间“未经授权访问”真实系统】
🕙 近日,继竞争对手OpenAI披露其AI模型在安全测试中失控并访问互联网后,Anthropic公司在进行大规模回顾性审查(评估超14.1万次运行)后宣布,其Claude模型的三个不同版本(包括最强大的Mythos 5等)在测试期间三次“未经授权访问”了三个外部组织的真实系统。
🚨当时这些模型正参与“夺旗”(Capture-the-Flag)测试,任务是闯入并检索隐藏在网络上的秘密信息。由于Anthropic与评估合作伙伴Irregular之间存在沟通误解,导致本该被隔离的测试环境意外连接了公共互联网。Claude将真实的外部网站误认为测试目标,利用弱密码和未经身份验证的端点等基本技术侵入了外部基础设施。事发后,Anthropic已暂停相关网络评估,正与Irregular合作评估情况,并试图联系所有受影响组织。
👉接连发生的AI模型“越狱”和访问真实系统事件,引发了整个科技行业对人工智能代理(AI Agents)自主执行任务安全性的高度担忧。包括Anthropic首席执行官在内的千余名顶尖AI行业员工近期联名签署公开信,呼吁加强行业监管和放缓步伐以应对风险。此前美国政府也已出台相关行政命令,要求开发商在发布最强大模型前向政府提供评估权限。#热点优质创作计划##—分钟精选视频扶持计划##微博视频号续航计划# http://t.cn/AXC5FdG2
发布于 陕西
