惊爆!美国AI巨头Anthropic自曝大模型Claude失控:擅自入侵3个组织系统且未被察觉!OpenAI模型亦失控:突破限制自行发起攻击
2026-07-31 15:45:41未知 作者:徽声在线
全球人工智能领域刚刚经历了一场前所未有的安全风暴,如今又再起波澜!
当地时间30日,美国人工智能领域的领军企业、OpenAI的最大竞争对手Anthropic发布声明称,其旗下的人工智能模型Claude在测试阶段竟然成功入侵了三个组织的系统。
就在仅仅10天前,OpenAI也公开承认,其旗下的AI大模型GPT-5.6 Sol以及一款尚未发布的模型在内部测试过程中“失控”,突破了隔离的测试环境,自主入侵了全球知名的人工智能开源平台——美国抱抱脸公司的生产数据库。抱抱脸公司在事后进行取证时,最初尝试使用通过商业应用程序接口提供的前沿闭源模型,却遭到了这些模型自身安全防护机制的误判拦截。关键时刻,抱抱脸公司转而选择在自己的基础设施上运行中国企业智谱开发的GLM-5.2模型进行取证分析,最终成功化解了这场危机。
尽管Anthropic和OpenAI这两家AI行业的巨头都试图淡化模型失控所带来的影响,但两家公司接连披露的此类安全事故无疑已经引发了行业的广泛警惕,同时也预示着在测试流程方面存在着诸多亟待解决的挑战。
Claude自主入侵三个组织系统
Anthropic坚称:此类风险完全可控
当地时间30日,Anthropic在声明中详细阐述了事件经过,其人工智能模型Claude在测试期间意外入侵了三个组织的系统。公司表示,在网络安全评估期间,由于配置出现错误,模型得以从本应严格隔离的测试环境中连接到互联网,从而获得了对系统的未经授权的访问权限。
Anthropic进一步补充称,公司在审查了高达141006次的测试会话后,才发现了这些令人震惊的事件。而这一审查流程是在OpenAI披露相关信息后紧急启动的。然而,被入侵的三个组织却对此次攻击活动毫无察觉,Anthropic在发现后已经迅速与受影响的组织取得了联系。
Anthropic透露,此次事件涉及三个不同的模型版本:Claude Opus 4.7、Claude Mythos 5以及一个内部研究模型。最早的入侵案例甚至可以追溯到今年的4月份。
这些攻击行为均发生在所谓的“夺旗”演练期间。在演练中,模型的任务是在模拟的网络环境中查找隐藏的信息。Anthropic表示,其提示信息明确告知模型它们没有互联网访问权限,但由于与评估合作伙伴Irregular之间存在误解,导致系统意外连接到了公共互联网。
Anthropic还补充称,公司于7月23日开始紧急审查评估记录,并在发现Claude可能访问过互联网的证据后,立即于当日暂停了所有网络安全评估活动。公司在7月24日之前确认了所有三起入侵事件,并于7月27日正式通知了受影响的机构。
Anthropic最后强调,通过加强监控与管控措施,并持续投入资源确保人工智能的发展与人类价值观保持高度一致,这类风险是完全可以被克服的。
值得一提的是,此前在7月8日,工信部网络安全威胁和漏洞信息共享平台就发布了关于防范AI编程工具Claude Code安全后门隐患的风险提示:
近日,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)在监测过程中发现,AI编程工具Claude Code存在严重的安全后门隐患。Claude Code作为美国Anthropic公司开发的AI编程工具,能够根据文字需求自主完成代码编写、修复等复杂工作。然而,由于其内置了监控机制,未经用户同意即可向远程服务器回传用户的地域、身份标识等敏感信息。受影响的Claude Code版本范围为2.1.91至2.1.196。
为此,平台建议相关单位和用户立即开展全面排查工作,对于安装上述受影响版本的开发终端,应立即卸载或升级至已清除相关后门代码的最新安全版本;同时,加强核心业务网段内开发工具的外联权限管控与流量监测,防止敏感数据违规外传。
OpenAI承认失控事件涉及多个平台
更多惊人细节被逐一曝光
据央视新闻7月30日报道,美国开放人工智能研究中心(OpenAI)在28日更新发布的调查结果中显示,该公司的人工智能模型在失控入侵美国抱抱脸公司系统期间,还曾利用网上公开的信息,访问了多个公开服务平台上的账户。
OpenAI不久前公开承认,该公司包括GPT-5.6 Sol在内的多个AI模型在内部评估时突破了隔离测试环境,成功入侵了运营人工智能开源平台的美国抱抱脸公司的系统。其最新公布的调查结果进一步揭示,涉事模型在攻击过程中还访问了至少4个公开服务平台上的4个账户。其中一个账户被用作中继与暂存通道;一个账户被用于数据存储;对另外两个账户仅进行了只读访问,并未用于进一步攻击抱抱脸公司的系统。OpenAI表示,已将调查结果及时通知了相关服务提供商。
OpenAI还透露,此次事件并未涉及任何计划近期发布的新模型,此前提及的涉事预发布模型仅供内部研究使用,目前已将其“停用、加密,并严格限制了研究访问权限”。
该公司表示,将继续与抱抱脸公司等方紧密合作开展调查工作,之后会分享调查结果的更多细节。
此次事件更多不为人知的内幕细节也被媒体逐一曝光。“抱抱脸”于7月16日率先披露了此次入侵事件,而OpenAI随后于21日才对外披露。当地时间7月26日,“抱抱脸”联合创始人兼首席执行官向OpenAI提出了两项明确要求,一是公开智能体的全部轨迹,二是将1亿美元算力用于支持开源社区。
同时,7月25日,有外媒援引知情调查人士的消息称,入侵Hugging Face的OpenAI智能体(Agent)曾展开了一场持续数日的“黑客狂欢”,直到威胁已被完全控制、联邦调查局(FBI)接到报警后很久,OpenAI才察觉到这一严重事件。
两家公司均已提交IPO申请
上市后估值均有望突破万亿美元大关
AI“失控”事件的频发,无疑为整个行业安全敲响了警钟。这些安全事件所暴露的核心危机在于,AI已经从原本“动口”的生成工具逐渐演变为能够“动手”的自主执行者。
当AI开始具备越来越强的自主决策能力时,如何建立与之相匹配的安全机制和监管框架,或许已经比模型性能竞争本身变得更加迫切。对于正全力冲刺IPO的OpenAI和Anthropic而言,这也将成为资本市场关注的重要议题。
据悉,Anthropic和OpenAI均已于今年6月正式提交了IPO申请。今年以来,Anthropic已完成至少两轮大规模融资,其估值从2月时的3800亿美元迅速升至5月的9650亿美元,甚至高于OpenAI的最新估值(8520亿美元)。两家公司上市后估值均有望轻松超过1万亿美元。
据新华社报道,业界专家纷纷表示,相关入侵事件再次为全球人工智能的发展与网络安全治理敲响了警钟。
英国工程技术学会网络安全和人工智能专家朱奈德·阿里指出,相关事件充分表明,人工智能模型往往倾向于寻找解决问题的捷径,却往往忽视了避免作弊等伦理问题。因此,未来应考虑将伦理推理强制内置于人工智能模型之中。同时,鉴于获得具有攻击能力人工智能技术的门槛越来越低,加快研发网络防御技术、提升安全团队应对能力已经刻不容缓。
随着人工智能已经深入千行百业,也逐渐融入普通人的日常生活,其安全风险也随之延伸至各个领域。索尔坦指出,人工智能模型在公开发布后,其内置的安全功能很可能遭到使用者的移除,相关风险将更加难以管控。
山东大学计算机科学与技术学院教授张悦表示,智能体时代最大的安全挑战在于传统安全边界正在逐渐失效。未来网络攻防很可能进入“智能对抗”阶段,即攻击者利用智能体自动发现漏洞、防御者利用智能体自动分析风险,双方都会充分利用人工智能来提升自身能力。
英国拉夫伯勒大学网络安全教授奥利弗·巴克利指出,网络安全的未来将不再是人类对抗人工智能的简单局面,而将是如何利用人工智能来保护人类免受其他人工智能的侵害。
(免责声明:文章内容和数据仅供参考,不构成任何投资建议。投资者据此操作,风险自担。)
编辑|段炼 杜波
校对|金冥羽
每日经济新闻综合自财联社、央视新闻、新华社
8000米高峰突发雪崩,10名登山者下落不明,其中包括中国和美国公民!世界著名登山家尼尔马尔·普尔贾也在失踪名单之中
贵州知名景区“伴漂”项目被指存在擦边行为,当地迅速通报:高度重视,已立即开展调查
日本成立“国家情报局”,初期人员规模约达730人!58岁原和也出任局长,曾任安倍晋三秘书官、内阁情报官等要职!专家:与“特高科”高度相似
iPhone销售火爆异常,苹果大中华区收入却未达预期,股价大幅跳水,市值蒸发超3000亿美元!库克坦言:正在为供应链问题苦苦挣扎
特朗普宣布达成“历史性协议”:哈马斯将全面解除武装!内容详细披露:哈马斯将交出所有武器,还将交出其隧道、武器工厂和仓库的详细地图


