复旦大学AI安全团队全球排名第二,白泽智能体展现卓越实力
2026-08-14 04:10:53未知 作者:徽声在线
在8月13日这一天,国际知名的AI安全基准测试平台CyberGym揭晓了其最新榜单,令人瞩目的是,复旦大学的研究团队所研发的白泽智能体Whitzard,凭借高达91.2%的真实漏洞攻防成功率,在全球范围内脱颖而出,荣获第二名,同时在高校团队中更是独占鳌头。这一成绩不仅超越了Anthropic公司专为网络安全打造的前沿模型Claude Mythos,还力压微软、Google等国际科技巨头旗下的Wiz等顶尖团队。此次测试规模宏大,涵盖了188个大型开源项目的共计1507个真实漏洞,对智能体的要求极为严苛,需要其在完整的代码库中自主完成漏洞的精准定位、攻击策略的巧妙构造以及攻击结果的严格验证。
复旦大学团队之所以能够取得如此骄人的成绩,得益于他们自主研发的模块化框架。这一创新框架仅需调用单个基础模型,便能通过将程序运行过程中的路径可达性等复杂问题转化为推理约束,从而实现精准且高效的收敛。在全量测试过程中,该模型的调用总成本竟然不足5000元人民币,这无疑彰显了其卓越的成本效益。值得一提的是,该智能体在此前的测试中曾取得68.9%的成绩,但经过团队对推理机制和验证环节的持续迭代与优化,最新版本已经成功攻克了1374个漏洞,实现了质的飞跃。为了推动AI安全领域的进一步发展,该团队还慷慨地将相关智能体框架和评测基准进行了开源。(信息来源:央视新闻)



