DeepSeek新模型V4.1 Flash内测启动,速度惊人引发热议!
2026-09-13 19:28:34未知 作者:徽声在线
徽声在线
作者 程茜
编辑 李水青
徽声在线9月8日最新报道,今日,DeepSeek官方正式对外宣布,旗下DeepSeek V4.1 Flash的中间测试版本已正式启动内测。据介绍,这款新模型在架构上进行了全面革新,原生支持多模态数据处理,性能更加强劲,处理速度显著提升,同时运营成本也得到了有效控制。
对于开发者而言,只需保持原有的base_url不变,将模型名称更改为deepseek-v4.1-flash-expires-on-0910,即可轻松调用这一新模型。在计费方面,当前内测版本的计费标准与DeepSeek V4 Flash保持一致,每账号并发限制为20。
与DeepSeek V4 Flash的定价策略相似,DeepSeek V4.1 Flash内测版本的价格也分为空闲时段和高峰时段。空闲时段,每百万tokens输入(缓存命中)的费用为0.05元,输入(缓存未命中)为1.5元,输出则为4.5元;而在高峰时段,对应的价格则分别上涨至每百万tokens输入(缓存命中)0.1元,输入(缓存未命中)3元,输出9元。
值得注意的是,根据模型名称中的提示,此次内测版本将于9月10日自动停止服务并下线。
在社交平台X上,已有不少开发者迫不及待地分享了自己的使用体验。其中,有开发者透露,该模型的最高输出速度竟然达到了惊人的507 tokens/s。
一位开发者尝试让模型创建HTML代码,内容是利用SVG绘制一个鹈鹕骑自行车的2D动画。令人惊讶的是,DeepSeek V4.1Flash仅用时75.4秒就完成了任务,输出速度高达328 tokens/s。
另一位开发者也进行了类似的测试,并展示了生成的效果图。他透露,在测试过程中,模型的平均输出速度超过了300 tokens/s。
还有网友表示,在手动添加该模型后,发现其处理速度非常快,几乎可以用“飞起”来形容。
回顾DeepSeek系列模型的发展历程,不难发现其近期更新迭代速度异常迅猛。
7月31日,DeepSeek V4 Flash正式版API率先上线,开启了公测阶段;紧接着,8月13日,DeepSeek V4 Pro正式版API也正式发布;同日,DeepSeek Harness的开发者预览版(v0.1版本)也正式公测,并同步进行了开源。仅仅几天后的8月19日,DeepSeek Harness就迭代至了v0.1.0-rc.8版本。
随后,在8月21日,DeepSeek V4 Flash Vision Exp也上线了DeepSeek API平台,并于8月31日正式开源,进一步丰富了DeepSeek的模型生态。
如今,DeepSeek V4.1 Flash的开启内测,无疑预示着其将开启新一轮的模型更新周期,为用户带来更多惊喜和可能。
