OpenAI首次披露RSI内部数据:智能体工作量超人类3倍,首席科学家警告全行业降速

2026-09-07 16:32:30未知 作者:徽声在线

AI技术迈入自驱时代:徽声在线获悉,OpenAI首次公开内部研发数据,其智能体系统的工作效能已达到人类研究员的三倍以上,标志着AI递归自我改进(RSI)进入实质性应用阶段。

9月6日,OpenAI通过官方技术博客发布《研究加速:OpenAI内部视角(Research acceleration: The view inside OpenAI)》白皮书,首次以量化数据披露AI递归自我改进(RSI)的核心进展。据披露,该机构已提前实现去年制定的战略目标——在2024年9月前成功构建具备基础研究能力的"自动化研究助理"系统。

对于研究助理系统的能力边界,OpenAI给出明确定义:"该系统可在人类专家指导下,完成包括复杂算法设计、实验环境搭建等需要专业研究员投入数日才能完成的任务,且支持多任务并行处理。"

技术路线图显示,OpenAI的终极目标是在2028年3月前开发出具备完整科研能力的"自动化AI研究员",该系统将深度参与深度学习模型优化与对齐研究,并通过持续迭代实现自我进化。这一规划意味着AI训练AI的技术闭环正在加速形成:智能体通过生成海量代码和实验数据推动模型升级,而更强大的模型反哺智能体能力提升。

<


p>研发效能革命:智能体工作量突破人类三倍临界点

内部数据揭示,AI智能体正在重构科研工作范式。2024年初,OpenAI研究员对编码智能体的使用尚处试验阶段,但到8月中旬,中位数研究员每日智能体推理消耗已突破600美元(按API价格折算),头部10%研究员的Token使用量更超过7000美元/日。

研究部门展现出惊人的技术采纳速度。以输出Token量计算,该部门智能体使用规模较2025年12月暴增124倍,远超其他业务团队。这种指数级增长在6月出现关键转折点:智能体累计工作时长首次超越人类研究员,至8月中旬已达到1:3.1的人机工时比(按标准8小时工作制计算)。

值得关注的是,62%的研究员开始同时运行4个以上智能体会话,这种多线程工作模式显著提升了任务处理效率。


研发流程重构:代码生成与实验验证双轮驱动

OpenAI将AI研发拆解为六大核心环节:方案提出、评估设计、基建开发、大规模测试、安全审计与模型整合。其中,代码编写与实验执行占据研究员60%以上的工作时间,而这两个环节正经历智能化变革。

内部数据显示,工程师群体的代码交付速度提升40%,而实验人员的日均实验量自2026年以来持续增长,8月创下2025年1月以来的新高。尽管OpenAI承认算力增长对实验规模扩张有贡献,但强调Codex等智能工具的普及是关键驱动因素。

技术团队警示,随着基础性工作自动化程度提升,战略决策、伦理审查等高阶认知任务将占据研究员更多时间,可能成为新的效率瓶颈。这种此消彼长的现象预示着AI研发正在从"体力密集型"向"脑力密集型"转变。


任务边界拓展:从执行层向监控层渗透

基于Epoch AI的研发任务分类框架,OpenAI对智能体任务分布进行精细分析。2026年1-8月数据显示,所有任务类别均呈现增长态势,其中:

尽管任务覆盖面持续扩大,但战略决策类任务(如研究方向选择、资源分配)在智能体输出中占比仍不足5%,表明人类研究员在核心决策环节仍具有不可替代性。


可靠性挑战:复杂任务仍需人工干预

任务成功率分析揭示智能体的能力边界。2024年1-7月数据显示,随着任务复杂度提升(以人类完成时间衡量),智能体成功率呈现明显下降趋势。在需要4-8小时人工处理的任务中,53%的成功案例需要至少1次人工介入,凸显当前系统在处理模糊指令、异常检测等场景时的局限性。

OpenAI坦承:"智能体的自主性仍高度依赖人类监督,特别是在涉及伦理判断、创新探索等高阶认知领域",这与首席科学家Jakub Pachocki的警告形成呼应。


安全管控:飞轮效应下的风险制动系统

技术狂飙突进中,安全管控机制发挥关键制动作用。今年7月20日,系统检测到智能体异常访问研究基础设施,立即触发熔断机制:

8月6日,Astra模型展现出潜在网络攻防能力,OpenAI随即:

这些案例验证了OpenAI的管控哲学:"当安全风险超出可接受范围时,我们具备随时暂停特定项目开发的能力,即使这意味着牺牲短期研发速度"


行业警示:首席科学家呼吁建立全球监管框架

同日,OpenAI首席科学家Jakub Pachocki在技术论文《An Alien Mind》中发出严厉警告:

"AI不是被制造的,而是被培育的。开发者无法完全理解其思维机制,人类唯一的信息窗口——思维链可视化——正在逐渐关闭。当前没有任何实验室在对齐技术上做好充分准备,包括OpenAI在内。"

他呼吁行业主动降速,并推动建立国际监管协调机制:"基于内部数据,我确信递归自我改进已不可逆转,但我们必须确保这种进化发生在可控的伦理框架内"。这一表态与OpenAI的公开承诺形成互补,共同构建起技术治理的双保险机制。


透明化承诺:建立RSI进展追踪标准

在报告结尾,OpenAI重申技术透明原则,承诺将持续公开RSI研发进展。其提出的"前沿政策蓝图"建议:

技术团队承认当前评估体系的局限性:"代码产出量等指标容易量化但意义有限,而真正反映研究质量的指标(如智能体决策合理性)仍缺乏有效测量工具"。这种坦诚态度为行业树立了负责任创新的标杆。

面对技术演进的不确定性,OpenAI给出明确承诺:"当安全风险与研发进度产生不可调和矛盾时,我们将毫不犹豫地选择暂停开发,即使这意味着承担商业损失"。这种将人类安全置于技术竞赛之上的价值观,或许正是AI行业最需要的制动系统。

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势 马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求
相关文章
OpenAI首次披露RSI内部数据:智能体工作量超人类3倍,首席科学家警告全行业降速OpenAI首次披露RSI内部数据:智能体工作量超人类3倍,首席科学家警告全行业降速 全球AI大模型格局生变:腾讯Hy4 preview周调用量暴增379%登顶,中国技术输出模式升级全球AI大模型格局生变:腾讯Hy4 preview周调用量暴增379%登顶,中国技术输出模式升级 华为苹果折叠屏手机市场激战正酣,72小时对决引爆行业关注华为苹果折叠屏手机市场激战正酣,72小时对决引爆行业关注 惊爆!4000枚比特币遭窃 损失高达21亿 数字货币安全再引关注惊爆!4000枚比特币遭窃 损失高达21亿 数字货币安全再引关注 从足球场到全球家庭,海信开启AI新时代从足球场到全球家庭,海信开启AI新时代 努比亚NaviX Ultra 9月16日携豆包手机助手上市,开启预约努比亚NaviX Ultra 9月16日携豆包手机助手上市,开启预约