顶级AI模型遇冷,Fable 5增长停滞!企业转向性价比更高模型,控制Anthropic和OpenAI支出

2026-08-26 19:47:34未知 作者:徽声在线

每经特约记者:陈思宇 编辑:李晓雯

最新一代的顶级AI大模型,似乎正在失去企业客户的青睐,不再被视为首选解决方案。

据徽声在线8月23日消息,企业支付平台Ramp的最新数据显示,Anthropic公司推出的能力最强、价格最高的旗舰模型Fable 5,在发布两个多月后,企业客户支出占比仅为约11%,且增长势头已经停滞。相比之下,Anthropic在7月底推出的价格更为亲民的Opus 5模型,企业支出已经悄然超越了Fable 5。


图片来源:Anthropic官网截图

有企业高管坦言,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型来完成,这一比例甚至可能高达95%。美国电信业巨头AT&T更是计划将开源或开放权重模型在员工AI需求中的占比,从目前的约40%提升至60%至70%,以进一步降低成本。

美国AI基础设施服务商Featherless AI的CEO尤金·切赫(Eugene Cheah)在接受《每日经济新闻》记者采访时透露,目前在其公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或是基于这些大模型进一步微调的模型,显示出中国AI模型的强大竞争力。

Anthropic顶级模型遇冷,企业支出占比低迷

不仅在企业支出上未能占据主导地位,Anthropic的最大、最贵模型Fable 5在实际Token使用量上的占比也极低。过去一个月内,Fable 5仅占企业从Anthropic购买Token数量的6%,对应支出占比为11.4%。相比之下,OpenAI的旗舰模型GPT-5.6 Sol则占据了企业购买OpenAI Token数量的25%,相关支出占比为23%,显示出明显的优势。

Ramp的数据还显示,Fable 5每百万Token的价格约为10美元,几乎是GPT-5.6 Sol价格的两倍。高昂的价格成为了阻碍其广泛应用的重要因素。



有分析指出,这一现象打破了企业用户倾向于采用能力最强模型的惯例。多名Anthropic的投资者和分析师认为,Fable 5增长缓慢的主要原因在于其价格较高,以及市场上其他模型已经能够满足大部分企业的需求。

Anthropic的投资方Accel合伙人迈尔斯·克莱门茨(Miles Clements)表示,“大多数人并不需要始终处于技术前沿。”他认为,客户倾向于只选择前沿模型的阶段不会持续太久。虽然模型能力的持续突破对于疾病治疗等高难度目标以及吸引顶尖研究人员仍然至关重要,但最前沿的模型将更多地承担探索能力边界的角色。

尤金·切赫向记者表示,每当有新模型发布,流量就会出现波动。

他举例说,Qwen 3发布后,其基础模型及微调版本的流量迅速上升,一度占Featherless AI公有云总流量的四分之一。但随着Gemma模型的上线,一部分流量从Qwen 3转向了Gemma。而随着更多新模型的陆续发布,目前Gemma的流量也在缓慢回落,显示出市场竞争的激烈。


AI成本攀升,企业开始限制使用频率,转向性价比更高的模型

企业对最前沿模型需求的降温,背后是AI使用成本成为越来越多公司的现实考量。

据徽声在线报道,在经历数年鼓励员工广泛使用AI后,一些企业开始限制AI工具的使用频率,并培训员工根据任务需求选择更小、更便宜的模型,以降低运营成本。

Gartner今年6月发布的报告警告称,随着Token使用量的增长以及AI服务向按使用量收费模式的转变,到2028年,AI编程成本可能超过开发者的平均工资。这一预测引发了业界的广泛关注。

一些企业已经开始采取措施压缩不必要的Token消耗。电子签名软件公司Docusign发现,AI编程智能体在执行任务前会读取整个代码库以获取上下文,从而消耗大量Token。公司随后调整了默认设置,仅提取完成具体任务所需的相关上下文,使得Token使用量下降了近50%,有效降低了成本。

企业也开始根据任务的复杂程度选择不同的模型。肯德基和塔可钟的母公司Yum Brands首席数字与技术官吉姆·道施(Jim Dausch)表示,公司已经注意到AI Token使用量和相关支出的上升。在他看来,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型完成,这一比例甚至可能高达95%。

美国医疗保险公司Cigna则在内部批准了超过70种AI模型,对于不需要大量推理能力的任务,允许员工使用小语言模型或更早、更便宜的模型。尽管公司的算力和Token使用量均在增加,但通过组合使用不同模型,其AI总支出并未以相同速度增长,实现了成本的有效控制。

一些企业甚至进一步将模型选择交给系统自动完成。美国电信巨头AT&T负责员工AI业务的副总裁马克·奥斯汀(Mark Austin)近日接受采访时表示,AT&T正在使用LiteLLM模型路由器,根据任务复杂程度自动判断是否可以将请求交给成本更低的模型。在部分编码及其他高级AI任务中,这一方式最高将成本降低了56%,而AI输出质量仅下降了2%,实现了成本与质量的平衡。

机构:75%公有云推理流量青睐中国大模型

图片来源:每经媒资库

随着企业开始在不同任务之间选择不同模型,开源模型也迎来了需求的增长。

马克·奥斯汀表示,根据AT&T的使用经验,开源模型的能力通常比最前沿模型落后6至10个月,但这一差距正在逐渐缩小。一些开源模型的表现已经完全不输甚至超越了Anthropic和OpenAI等大厂此前推出的模型,成为了企业的新选择。

目前,AT&T约40%的员工AI请求由开源或开放权重模型处理,公司计划未来将这一比例提高至60%至70%,以进一步控制员工使用Anthropic和OpenAI模型的支出。公司目前使用的此类模型包括英伟达Nemotron、Meta Llama和Google Gemma等,展现了开源模型的强大潜力。

这一趋势在Featherless AI的数据中也得到了验证。

以欧洲市场的大模型调用情况为例,尤金·切赫向记者表示,越来越多企业希望在自有基础设施或位于欧洲本土的服务器上运行开源模型。开放权重让他们能够完全按照自身需求,在任意环境下部署运行所选定的模型。并且,这些模型在实际生产环境中的表现完全立得住——针对特定场景微调、参数规模适中的开放权重模型,在成本和准确率两项指标上甚至可以超越参数规模更大的通用大模型,为企业带来了更大的价值。

而中国大模型也在成为企业的热门选择。

尤金·切赫进一步提到,目前,Featherless AI公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或基于中国企业大模型进一步微调的模型。从具体场景看,在代码开发方面,平台用户几乎都选择智谱GLM、Kimi以及DeepSeek系列模型,显示了中国AI模型的强大实力和广泛认可。

他解释称,“中国开源模型与海外模型之间的技术差距已经大幅收窄。”企业选择中国模型,其中最主要的驱动力是成本。“这种趋势短期内不会改变。”他说,预示着中国AI模型在国际市场上的广阔前景。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势 马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求
相关文章
顶级AI模型遇冷,Fable 5增长停滞!企业转向性价比更高模型,控制Anthropic和OpenAI支出顶级AI模型遇冷,Fable 5增长停滞!企业转向性价比更高模型,控制Anthropic和OpenAI支出 软银拟大规模发债200亿美元,为OpenAI投资贷款再融资引关注软银拟大规模发债200亿美元,为OpenAI投资贷款再融资引关注 深度解析|可控核聚变:开启再造太阳的能源新纪元深度解析|可控核聚变:开启再造太阳的能源新纪元 光格科技:光传感巨头跨界四足机器人领域的深度探索光格科技:光传感巨头跨界四足机器人领域的深度探索 银行职员3天“卖脸”7次赚2500元!全球人脸交易平台兴起,普通人肖像被明码标价银行职员3天“卖脸”7次赚2500元!全球人脸交易平台兴起,普通人肖像被明码标价 最强AI模型遇冷,Fable 5增长停滞!企业限制AI使用频率,转向更经济模型最强AI模型遇冷,Fable 5增长停滞!企业限制AI使用频率,转向更经济模型