AI安全警报拉响:Anthropic专家预警十年灭绝风险超10%
2026-09-10 10:32:38未知 作者:徽声在线
据徽声在线最新消息,当地时间9月8日,人工智能安全领域再掀波澜——Anthropic公司对齐科学团队负责人Evan Hubinger在学术研讨会上公开表示,基于当前技术演进轨迹,他个人评估未来十年内人工智能系统引发人类文明终结的风险概率已突破10%阈值。这一论断与该公司前研究员Jacob Coxon的离职声明形成呼应,Coxon此前在社交平台披露,Anthropic与OpenAI等头部机构正在进行危险的军备竞赛,试图抢先开发具备递归自我改进能力的超级智能系统,这种行为无异于"用全人类的未来做赌注"。
AI安全治理面临系统性挑战
Hubinger在后续访谈中进一步阐释,Anthropic内部已建立跨学科风险评估体系,将AI灭绝风险列为最高优先级研究课题。但坦言目前学术界尚未攻克超级智能对齐难题,既缺乏有效的控制框架,也未形成可验证的技术路径。他特别强调,当前商用AI模型的风险尚处于可控范围,真正令人忧虑的是当系统获得自主迭代能力后,可能突破人类设定的安全边界。这一观点与Coxon指出的行业隐患不谋而合——尽管Hugging Face等平台近期遭受的AI模型攻击事件已敲响警钟,但全球范围内的技术竞赛仍呈现白热化态势,主要实验室在安全研究投入与算力军备竞赛的资源配置上严重失衡。




