FXTM富拓集团资讯:继OpenAI后,Anthropic也报告三起模型逃逸攻击事件
Anthropic公司周四表示,在一次安全评估期间发现其 Claude 模型发生 3 起异常联网事件,未经授权访问三家机构的真实系统。
该公司表示,在开展大规模回溯审查后排查出上述事件。此番审查的起因,是 OpenAI 上周对外披露了另一起性质相近的安全事故。
OpenAI上周表示,其多个模型联手突破了一处互联网访问权限高度受限的隔离测试环境。这些模型接连利用一系列漏洞接入公网,最终访问到开源开发者平台运营方 Hugging Face。
在 Anthropic 发现的三起事件中,其模型在与第三方测评合作方 Irregular 提供的测试环境交互时接入互联网。Anthropic 称,公司此前告知 Claude 模型所处环境为无法联网的模拟场景;但由于公司与测评合作方之间信息沟通出现偏差,实际环境能够连通网络。
随后这些模型借助基础攻击手段入侵相关机构,例如访问无需身份验证的接口、破解弱密码。Anthropic 并未披露遭到入侵的三家机构名称。
Anthropic 在声明中表示:“归根结底,多方面因素共同引发了这些事件。但秉持无责复盘的理念,我们将以全责视角推进整改工作。
Anthropic 此次披露的事件,进一步加剧了科技行业对人工智能网络攻击能力快速提升的担忧。近几个月,OpenAI 与 Anthropic 均就此风险发出过警示。在 Hugging Face 入侵事件曝光后,美国两名国会议员提出《人工智能紧急关停法案》,要求 AI 企业具备相应能力,一旦模型失控,可对其执行关闭、限流或暂停操作。
Anthropic表示,共有三款模型卷入本次入侵事件,分别是 Opus 4.7、Mythos 5 以及一款内部研发测试模型。Mythos 5 是 Anthropic 于 6 月推出的高级模型,因其具备强大的网络攻防能力,目前仅向选定用户开放。该模型的早期版本已于 4 月发布,当时吸引了华尔街与多国政府官员密切关注。