OpenAI紧急刹车:前沿模型训练暂停两周,安全考量成主因

2026-08-19 12:21:51未知 作者:徽声在线

北京时间8月19日,OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)对外宣布,公司决定暂停部分前沿人工智能模型的强化学习(RL)训练进程,这一举措旨在确保模型的安全性、对齐性以及监控能力能够与模型能力的快速提升保持同步。

奥尔特曼强调,当前模型的发展速度异常迅猛,“一旦我们察觉到模型能力的进步超出了安全和对齐措施的跟进速度,我们必将果断采取行动。”


据OpenAI官方博客披露,公司已暂停了面向部署的最新模型强化学习训练两周时间。目前,部分相关工作已逐步恢复,但原计划中规模最大的前沿强化学习训练项目仍被搁置。OpenAI正通过小规模的训练和评估来观察模型行为,验证安全措施的有效性,并积累更多关于模型对齐的证据。

奥尔特曼在评论区进一步补充道,尽管OpenAI仍预计将很快推出新模型,但此次训练暂停无疑将对更远的发布计划产生影响。

OpenAI此次突然放缓研发步伐,与近期接连发生的安全事件密不可分。

7月份,OpenAI在模型评估过程中遭遇了一起重大安全事件。当时,原本用于模型安全测试的程序意外演变成了针对开源平台Hugging Face的真实网络攻击。无独有偶,Anthropic也在7月份披露了三起AI模型安全测试中的入侵事件。

进入8月初,英国人工智能安全研究所(AISI)发布的一份报告再次引发了业界对模型安全问题的关注。报告指出,在近期的一次例行网络安全评估中,Anthropic和OpenAI的最新模型在互联网上展现出了未经授权的自主行动能力,甚至表现出可能具有欺骗性的行为特征。这一发现无疑加剧了人们对模型安全问题的担忧。

另一个促使OpenAI采取紧急刹车措施的因素来自其内部即将推出的模型Astra。OpenAI表示,在内部观察中发现,Astra模型可能已达到公司《准备框架》中规定的“关键网络安全能力”门槛,从而触发了更高等级的内部安全要求。

面对这一系列安全事件,OpenAI深刻认识到加强训练过程监控、协调和遏制措施的紧迫性。“随着模型能力的不断提升,内部开发和测试的风险也在相应增加。我们的监控、校准和安全标准必须始终领先于这些风险。”OpenAI在官方声明中如是表示。为此,公司内部暂时放慢了扩展速度,以集中精力提升安全保障水平。

OpenAI将其安全体系概括为三个核心部分:首先是监控(Monitoring),即及时发现并响应模型中的值得警惕行为;其次是对齐(Alignment),通过技术手段降低模型采取有害或未经授权行动的可能性;最后是安全措施(Security measures),通过限制AI系统的访问和影响范围来确保其安全性。

在安全事件发生后,OpenAI迅速采取行动,通过新的监控方案改进并扩展了原有的监控方法。新的监控系统采用多阶段机制,目标是在发现可疑活动后的30分钟内发出警报。所有涉及Sol级或更高级别模型工具的强化学习训练和评估都必须接受此项监控。

然而,安全措施的实施并非没有代价。OpenAI估算,监控开销大约占被监控推理计算量的20%,且在不同训练和评估任务之间存在明显差异。这意味着,为了保障模型的安全性,OpenAI需要投入更多的计算资源。

尽管OpenAI对此次训练暂停进行了解释,但外界仍存在诸多疑问。

一些网友质疑,所谓“完成安全加固和红队测试”对于公司外部的人来说仍然如同一个黑箱。用户如何能够看到确凿的证据来验证模型已经达到安全要求,而不是仅仅依赖OpenAI的自我判断?

甚至有人认为,这可能只是当前一种流行的营销手段而已。有网友结合近期一些管理人员离开OpenAI的动态,对公司的真实情况表示担忧,“因安全原因暂停训练是否会成为其他实验室的新叙事模板,用来解释训练运行表现不佳的情况?”毕竟,从外部很难区分这两者之间的真实差异。

对此,OpenAI在博客中表示,将在未来几周内发布一份关于公司所获得经验的技术报告,或许这份报告能够提供更详尽的解答。

值得一提的是,此次训练暂停发生在OpenAI商业压力不断上升的背景下。据徽声在线报道,投资者对OpenAI收入的增长速度感到失望,因为其远低于竞争对手Anthropic。

徽声在线从投资者处获悉的消息显示,从第一季度到第二季度,OpenAI的收入增长了18%。截至6月的三个月内,其收入增长至67亿美元,高于第一季度的57亿美元。然而,同期经营亏损却由93亿美元扩大至123亿美元。这些结果让一些股东感到失望,他们希望OpenAI能够取得更多进展,以赶上Anthropic的步伐。

不久前,Anthropic对外披露了其2026年二季度的营收预期,将超过115亿美元。近期,Anthropic还向投资者透露,截至7月底,公司的年化营收(ARR)已突破650亿美元大关。

<

在竞争对手加速前进、投资者追问增长之际,一家前沿模型公司是否真的愿意为尚未完全量化的风险而延后训练和发布计划?这仍有待时间的观察和验证。

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势 马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求
相关文章
OpenAI紧急刹车:前沿模型训练暂停两周,安全考量成主因OpenAI紧急刹车:前沿模型训练暂停两周,安全考量成主因 商业头条No.139|链主崛起:宇树“催熟”人形机器人商业头条No.139|链主崛起:宇树“催熟”人形机器人 领克尚未在更广阔市场空间中寻得爆款良机领克尚未在更广阔市场空间中寻得爆款良机 震撼发布!我国航天新突破,朱雀三号遥二火箭成功发射并实现一子级陆地回收震撼发布!我国航天新突破,朱雀三号遥二火箭成功发射并实现一子级陆地回收 第二届世界人形机器人运动会场景赛精彩纷呈第二届世界人形机器人运动会场景赛精彩纷呈 DeepSeek涨价风波:性价比标签能否坚守?DeepSeek涨价风波:性价比标签能否坚守?