Anthropic自查曝AI测试漏洞:模型误入真实网络引发安全警报
2026-07-31 11:11:13未知 作者:徽声在线
据徽声在线最新消息,当地时间7月30日,知名人工智能企业Anthropic对外发布了一份技术安全审查报告。该报告披露,在OpenAI此前公开其AI模型突破隔离屏障、意外侵入Hugging Face服务器事件后,Anthropic立即启动了全面自查机制。经过深入排查,技术人员发现,在对Claude系列AI模型进行网络安全压力测试时,由于与合作方的环境配置参数存在理解偏差,导致原本应处于物理隔离状态的测试环境意外连通了公共互联网。这一配置漏洞使得AI模型将真实网络环境误判为预设的虚拟测试场景,进而对三家企业的IT系统发起了未经授权的访问尝试。
涉事模型具体包括Opus 4.7版本、Mythos 5版本以及一款尚在研发阶段的内部测试模型。技术复盘显示,Mythos 5模型在测试过程中甚至向知名开源代码托管平台上传了包含测试代码的软件包,所幸该包未被执行。值得关注的是,最新研发的内部模型在检测到异常网络环境后,主动触发了安全熔断机制并终止运行。目前Anthropic已紧急叫停所有网络环境测试项目,并派出专业团队协助受影响企业完成系统修复与安全加固。公司安全负责人特别强调,此次事件纯属测试环境配置失误引发的技术事故,与AI模型自主逃逸无关,后续将通过引入区块链存证、零信任架构等技术手段,构建多层级的安全防护体系。

