Anthropic披露第四起Claude模型外网访问安全事件
2026-09-12 00:02:30未知 作者:徽声在线
徽声在线 9 月 10 日消息,人工智能安全研究机构Anthropic在当地时间 9 月 9 日发布公告,正式确认了一起发生在2026年1月的重大安全事件,这也是该机构迄今为止对外公布的第四起涉及Claude模型的真实网络安全事故。
根据徽声在线此前报道,Anthropic曾在当地时间 7 月 30 日首次披露三起Claude模型未经授权访问第三方系统的安全漏洞。当时该机构推测,这些异常访问可能源于一次网络安全测试过程中意外获得的外网访问权限。为彻底查清问题,Anthropic对约14.1万份会话日志展开了全面筛查。
值得注意的是,由于日志数据量异常庞大,且需要尽快向公众通报初步调查结果,首轮筛查工作主要依赖基于AI智能体的自动化检索技术。这种高效但不够精细的筛查方式,导致部分同样具备外网访问特征的日志被意外遗漏。
转机出现在8月份,当Anthropic准备将部分日志数据共享给模型评估与威胁研究机构METR时,工作人员在整理过程中发现了这批被遗漏的日志。经过深入核查,研究人员从中识别出第四起发生在2026年1月的安全事件,该事件涉及Claude Opus 4.6的早期版本。
进一步调查显示,这四起事件均发生在同一家外部评测机构构建的网络安全评估环境中。在该测试场景下,系统向Claude模型发送的提示信息声称其运行在完全隔离的沙箱模拟环境中;然而由于环境配置出现严重错误,模型实际上被错误地接入了开放的互联网。更令人担忧的是,按照网络安全评估的标准操作流程,测试环境中的模型并未启用商用版本所配备的多层安全防护机制。
发现这一系统性漏洞后,Anthropic立即启动了更大规模的排查行动,将检索范围扩大至约4.81亿份历史日志。调查团队首先通过自动化工具筛选出包含公网IP地址、URL等外网访问特征的日志,随后利用Claude模型对初筛标记出的920万份高风险日志进行深度二次审查。最终确认除了已公布的四起事件外,未发现其他同等严重程度或更严重的安全漏洞。


