Anthropic震撼发布Fable 5.1:性能飙升,缓存读取价格直降75%
2026-09-02 12:52:55未知 作者:徽声在线
9月2日,知名人工智能企业Anthropic正式对外推出其新一代旗舰级大模型——Claude Fable 5.1与Claude Mythos 5.1。这两款被业界誉为“孪生模型”的新品,被Anthropic定义为“全球最顶尖的编程与知识工作解决方案”。其中,Fable 5.1面向全球所有用户及企业全面开放,而Mythos 5.1则采取更为严格的审核机制,仅向符合条件的美国网络安全与生命科学机构提供。此次发布,距离Anthropic今年6月推出Fable 5系列仅过去三个月,展现了其在AI领域的快速迭代能力。
在多项关键性能测试中,Fable 5.1实现了显著的性能飞跃。特别是在衡量AI自主科研能力的Terminal-Bench-Science0.1测试中,其得分从上一代的24.7%大幅提升至52.6%,几乎翻了一番。与此同时,Anthropic还宣布对缓存读取价格进行大幅下调,并同步推出了全新的企业级前沿安全系统,以进一步提升用户体验和数据安全。
根据Anthropic官方公布的价格策略,Fable 5.1在基础输入和输出价格上保持了与Fable 5相同的水平,即每百万Token输入10美元、输出50美元。然而,在缓存读取(Cache Read)方面,价格却从此前的每百万Token1美元大幅降低至0.25美元,降幅高达75%,这无疑将为用户带来更为经济的成本结构。
缓存读取作为模型处理重复输入内容时的计费项,在智能体任务和长对话场景中尤为常见。因此,此次价格下调对于降低实际使用成本具有深远影响,远超表面数字所体现的幅度。
Anthropic官方测算显示,在典型工作负载下,Fable 5.1的使用成本较Fable 5降低了约25%;而在高度智能体化的工作负载中,成本降幅更是高达约45%。此外,Fable 5.1还保持了100万Token的上下文窗口和12.8万Token的最大输出长度,确保了其在处理复杂任务时的稳定性和高效性。
据Anthropic官网发布的技术报告透露,Fable 5.1与Mythos 5.1实际上是同一底层模型的两种不同配置形态。Fable 5.1作为公开版本,加装了更为严格的安全护栏,以防止模型在生物学、网络安全等高风险双重用途领域执行特定任务;而Mythos 5.1则在这些领域采用了更为宽松的安全策略,其直接访问权限仅限于通过可信访问计划审核的个人和组织。同时,Mythos 5.1的能力还为面向所有Claude企业客户的Claude Security产品提供了有力支持。
Anthropic表示,这种“同一模型、两套安全策略”的发布模式,旨在在推动模型能力不断突破的同时,有效管控高风险领域的潜在滥用风险,确保AI技术的健康发展。
在性能表现上,Fable 5.1在最具标志性的Terminal-Bench-Science0.1基准测试中,以52.6%的得分将上一代Fable 5(24.7%)和Open AI的GPT-5.6Sol(22.4%)远远甩在身后,甚至超过了自家定位更高的Opus 5(29.0%),实现了超过一倍的性能提升。这一基准测试被业内视为判断模型科研潜力的核心指标,主要衡量AI模型在终端环境中自主完成科学研究任务的能力。
Fable 5.1 在各类基准测试中的卓越表现
在衡量终端编码能力的Terminal-Bench4.0测试中,Fable 5.1得分达到55.8%,较上一代的42%有了显著提升;而安全护栏更为宽松的Mythos 5.1更是达到了60.9%的高分。在其他多项基准测试中,Fable 5.1同样展现出了全面领先的优势:GDPval-AA v2知识工作测试得分1853分,超越了Opus 5的1824分;Automation Bench业务流程自动化得分31.4%,较上一代的17.1%近乎翻倍;Cursor Bench3.2.0智能体编码测试得分73.4%,Humanity's Last Exam多学科推理测试在有工具辅助下达到65%,OSWorld 2.0计算机操作测试在严格评分标准下达到41.7%,均刷新了行业纪录。
Fable 5与Fable 5.1运行相同工作负载的成本对比详解
值得一提的是,Fable 5.1在低、中等推理强度设置下,其性能已经能够接近甚至超过上一代Fable 5在最高推理强度下的表现。官方数据显示,当Fable 5.1设置为Low或Medium推理强度时,在多数任务上的表现与Fable 5的High设置相当或更优,而单次任务成本却显著降低,为用户带来了更为经济的选择。
Anthropic在官网介绍中详细展示了Fable 5.1与Mythos 5.1在真实科学研究中的卓越表现。在蛋白质设计领域,Mythos 5.1通过调用开源蛋白质设计与折叠工具生成结合剂,并交由两家外部机构进行实验验证。结果显示,在3个靶点上,其亲和力达到了Adaptyv Bio竞赛最佳方案的10倍;在12个靶点上,有效结合剂命中率接近50%,远超行业典型水平(10%—15%)。
Fable 5.1在天文计算领域的创新突破
在天文计算领域,Fable 5.1基于NASA麦哲伦号30多年前的雷达数据训练神经网络,成功重绘了金星约三分之一表面的高分辨率高程图。其分辨率从原有的10—20公里提升至2—3公里,高程精度提高了最多25%。这张地图以Creative Commons许可开源,为天文研究提供了宝贵的数据资源。此外,在GPU内核优化方面,Mythos 5.1为7个开源深度学习模型编写了定制GPU内核并缓存了中间结果,使得推理速度最高提升了2.5倍;同时,全基因组分析GPU成本预计将降低30%—60%,为生物信息学研究带来了革命性的变化。
然而,值得注意的是,基准测试成绩并不完全等同于实际使用体验。不同模型在不同任务类型和应用场景下各有优劣。尽管Fable 5.1在编码和科研任务上表现突出,但在创意写作、多模态理解等维度的表现仍有待实际用户的广泛验证和进一步优化。


