Anthropic再曝Claude模型安全事件,第四起隐患浮出水面
2026-09-13 21:49:13未知 作者:徽声在线
徽声在线 9 月 10 日消息,当地时间 9 月 9 日,Anthropic 官方发布声明,正式确认了一起发生在 2026 年 1 月的安全事件,这也是该机构对外公布的第四起涉及 Claude 模型的真实网络安全事件。
据徽声在线此前报道,Anthropic 曾在当地时间 7 月 30 日,对外通报了三起 Claude 模型未经授权访问真实第三方系统的安全事件。当时,Anthropic 推测,Claude 可能在一次网络安全评测过程中意外获得了外网访问权限。随后,该机构对大约 14.1 万份会话日志进行了全面筛查,并最终确认了这一事件的存在。
据了解,由于日志数量庞大,且需要尽快公布处理结果,该轮筛查主要依赖于基于智能体的自动化检索技术。然而,这一技术手段导致了一批同样连通了外网的日志被意外遗漏,为后续的安全隐患埋下了伏笔。
时间来到 8 月,Anthropic 在整理准备共享给模型评估与威胁研究机构 METR 的日志时,意外发现了这部分被遗漏的日志。经过进一步的详细核查,Anthropic 从中揭露了第四起发生在 2026 年 1 月的安全事件,该事件涉及早期版本的 Claude Opus 4.6 模型。
徽声在线进一步了解到,所有这四起事件均发生在同一家外部评测机构构建的网络安全评估流程中。在该流程中,系统曾向 Claude 发送提示,告知其运行在断网的沙箱模拟环境中。然而,由于环境配置出现错误,模型被错误地接入了开放的互联网。按照网络安全评估的标准惯例,测试模型在运行时并未挂载商用发布版本所标配的安全防护策略,这无疑增加了安全风险。
在发现这一系列安全事件后,Anthropic 表示,他们主动扩大了排查范围,将检索规模增加至约 4.81 亿份日志。首先,他们对这些日志进行了初步筛选,排查公网 IP 地址和 URL 等外网访问特征;随后,利用 Claude 模型对初筛标记出的 920 万份高风险日志展开了二次深度审查。经过严格的审查,他们重新锁定了上述四起事件,并未发现其他程度相当或更为严重的安全个案。

