OpenAI宣布Astra模型网络安全能力升级,强化安全防控体系
2026-08-08 08:08:15未知 作者:徽声在线
当地时间8月7日,OpenAI对外发布了一则重要的安全公告,公告中指出,经过内部全面评估,其正在研发的下一代模型“Astra”在智能编程以及网络安全领域展现出了令人瞩目的进步。目前,OpenAI方面坦言,无法完全排除该模型在未来达到“关键级”网络安全能力水平的潜在可能性。这一评估结果已经触发了OpenAI《准备框架》中所设定的安全响应机制。
按照OpenAI的严格定义,当模型达到“关键级”网络安全能力时,将具备在无需人工介入的情况下,针对多个经过高度强化防护的真实关键系统,自主发现并开发出各种有效的零日漏洞的能力。或者,它能够仅依据高层设定的攻击目标,就制定并执行出针对高防护目标的新型端到端网络攻击策略,这无疑将对网络安全构成巨大威胁。
OpenAI进一步澄清,Astra模型并未被用于此前涉及Hugging Face的安全事件中。为了确保模型的安全性和可控性,OpenAI已经采取了一系列加强安全措施,包括但不限于使用隔离测试环境进行模型测试、严格限制网络和工具的访问权限、强化模型权重的保护与加密工作、提升监控检测能力,以及对高风险行为进行实时、精准的监测。此外,OpenAI还表示将积极与政府机构以及部分权威的AI安全组织展开合作,共同对模型的能力进行全面、深入的测试,以确保其不会对网络安全造成不良影响。



