OpenAI倡议全球AI标准制定:聚焦对齐研究与RSI技术审慎推进
2026-09-29 04:57:41未知 作者:徽声在线
据徽声在线消息,OpenAI于周一正式对外公布了一套针对前沿人工智能(AI)开发过程中安全与保障问题的全面提案。该提案将核心关注点放在了AI对齐研究以及一种名为“递归自我改进”(RSI)的前沿计算技术上。OpenAI在官方博客中明确指出:“为了确保AI技术能够平稳且安全地完成这一重大转型,对齐研究必须紧密跟随AI能力的发展步伐。只有这样,我们才能确保由我们以及其他机构所构建的AI系统,始终与人类的核心价值观保持高度一致,并且始终处于人类的严密控制之下。”为此,OpenAI积极呼吁全球各国加强国际合作,共同制定前沿AI技术的统一标准,并建议充分借鉴世界各地现有AI安全机构的宝贵经验和成果。
作为ChatGPT的研发者,OpenAI进一步强调,这些技术标准应当重点聚焦于前沿AI模型及其开发者,同时全面考虑自动化AI研究人员在收益与风险管理方面的特殊需求,其中RSI技术更是重中之重。
RSI技术之所以能够激发AI开发者的极大热情,主要源于其有望开创出一种全新的AI发展模式——无需人类直接干预,AI系统便能实现自我升级和优化。然而,随着RSI技术的不断突破,一些技术领域的专家开始表达出深深的忧虑。他们担心,随着基础模型的不断进化,制造商可能会逐渐失去对底层技术的有效控制,或者由于AI系统的日益复杂和广泛分布,而未能充分预见其可能带来的潜在意外后果。
OpenAI在博客中进一步阐述道:“目前,完全自主的RSI技术尚未成熟,且在实现安全应用之前,我们绝不应盲目推进。如果缺乏必要的审慎态度和有效保障措施,RSI技术很可能导致人类逐渐失去对AI发展的实际控制权,进而无法对那些已经超出人类理解范围的研究过程进行有效监督。”
此外,OpenAI的博客还特别提及了Hugging Face被入侵事件。虽然该事件并未直接涉及RSI技术,但OpenAI认为,它无疑为整个行业敲响了警钟,预示着如果没有强有力的保障措施和对齐机制,AI技术所带来的风险可能会变得愈发严重和不可控。
AI安全争议持续升级:Anthropic呼吁“减速”,第三方评估机制呼声日益高涨
就在不久前,OpenAI的竞争对手Anthropic也提出了其关于前沿AI模型安全开发的独特设想。这一设想的提出,是对近期行业研究人员对AI可能威胁人类安全的一系列警告的直接回应。大约两周前,曾同时任职于Anthropic和OpenAI的Jacob Coxon宣布辞职,并公开指责这些公司是在“以我们的生命为赌注”,这一言论迅速引发了全球范围内的广泛讨论。
在近期一系列AI安全事件以及Coxon的公开发声之后,Anthropic的CEO达里奥·阿莫代伊发表了一篇长文,呼吁AI公司放慢基础模型的开发速度,并提出了其他一系列富有建设性的建议。
阿莫代伊还特别提出,在公司内部引入第三方评估人员的想法,以全面审核和缓解其技术可能给社会带来的潜在风险,如加剧网络安全领域的黑客攻击活动或助力生物武器的制造等。
OpenAI的CEO萨姆·奥尔特曼,以及特斯拉和SpaceX的CEO埃隆·马斯克等业界领袖,也纷纷公开表示支持阿莫代伊的这一提议。
然而,由于AI评估领域目前仍处于发展的初级阶段,对于如何让独立第三方更深入地审查尖端技术所需的基本标准和原则,业界尚未形成统一的共识。
这在一定程度上促使一群AI评估领域的专家开始敦促基础模型制造商考虑实施一系列“最低要求”,以便更深入地开展技术相关的审查和检查工作。这些要求包括获得更深层次的系统访问权限,以及确保评估人员不会因发布不利报告而遭到报复等。
