智源深度评估:大模型智能体或引发严重生物安全挑战
2026-07-22 20:33:49未知 作者:徽声在线
7月22日最新消息,随着人工智能技术的迅猛发展,AI的应用边界正不断拓展,从传统的信息处理领域逐渐延伸至物理实验操作层面。在此背景下,一个备受关注的问题浮现出来:当AI具备操作物理实验的能力时,生物安全的边界将会发生怎样的变化?针对这一疑问,智源研究院大模型安全研究团队携手北京大学,共同开展了一项全面且深入的端到端系统性评估工作。
此次评估的核心聚焦于大语言模型智能体对非专业人员的影响,具体而言,就是考察这些智能体是否会降低非专业人员绕过DNA合成筛查的知识门槛。评估过程严谨且细致,从智能体生成DNA分片方案开始,接着进行程序化计算校验,最后延伸至标准分子生物学实验室中的受控湿实验环节。在湿实验中,研究人员通过电泳和测序等先进技术,确认模型方案在物理层面的可执行性,确保评估结果的准确性和可靠性。
评估结果令人深思。所有参与测试的11个大模型均展现出了强大的能力,它们都能生成通过计算校验的DNA分片方案。其中,GPT - 5.5和Claude Opus 4.6表现尤为突出,不仅能生成方案,还能提供详细的逐步实验指导,仿佛为非专业人员配备了一位虚拟的“实验导师”。在物理验证环节,4个良性代理构建体全部成功完成组装,这一结果进一步证实了大语言模型智能体在生物实验领域的潜在影响力。
这一评估结果意味着,大语言模型智能体的广泛应用可能带来一系列严峻的生物安全问题。一方面,它们可能削弱现有DNA合成筛查防线,使得一些原本被拦截的潜在风险得以绕过;另一方面,它们还可能向不具备专业背景的用户提供原本依赖专业训练才能获得的实验操作知识,从而引发相关双重用途风险。因此,对大语言模型智能体进行系统性地评估与提前防范刻不容缓,只有这样才能确保生物安全领域的安全与稳定。
