重磅!DeepSeek V4.1 Flash内测开启,速度惊人引发热议!
2026-09-12 07:48:16未知 作者:徽声在线
徽声在线
作者 程茜
编辑 李水青
徽声在线9月8日报道,就在刚刚,DeepSeek官方正式对外宣布,旗下DeepSeek V4.1 Flash的中间版本正式开启内测阶段。这款新模型在架构层面进行了全面革新,不仅原生支持多模态数据处理,而且在性能上实现了显著提升,处理速度更快,同时运营成本更低。
对于开发者而言,调用方式极为简便,只需保持base_url不变,将模型名称设置为deepseek-v4.1-flash-expires-on-0910即可轻松接入。在计费方面,当前内测版本的计费标准与DeepSeek V4 Flash保持一致,每账号并发限制为20。
在价格方面,DeepSeek V4.1 Flash内测版本与DeepSeek V4 Flash相同,空闲时段每百万tokens的输入费用(缓存命中时)为0.05元,输入费用(缓存未命中时)为1.5元,输出费用为4.5元;而在高峰时段,对应的价格则分别为每百万tokens输入(缓存命中)0.1元,输入(缓存未命中)3元,输出9元。
值得注意的是,根据模型名称中的提示,此次内测版本将于9月10日自动过期并下线,因此开发者需抓紧时间体验。
在社交平台X上,已有不少开发者迫不及待地分享了自己的使用体验。其中,有开发者晒出了惊人的输出速度,最高达到了507 tokens/s,这一速度无疑令人瞩目。
一位开发者尝试让模型创建HTML代码,内容是利用SVG绘制一个鹈鹕骑自行车的2D动画。令人惊喜的是,DeepSeek V4.1Flash仅用时75.4秒就完成了任务,输出速度高达328 tokens/s。
另一位开发者也进行了相同的测试,并展示了生成的效果图。他透露,在测试过程中,模型的平均输出速度超过了300 tokens/s,表现相当出色。
还有网友表示,在手动添加该模型后,发现其处理速度非常快,几乎达到了瞬时响应的水平。
回顾DeepSeek系列模型的发展历程,不难发现其近期更新频率极高,不断推陈出新。
7月31日,DeepSeek V4 Flash正式版API率先上线公测,为开发者提供了全新的选择;8月13日,DeepSeek V4 Pro正式版API发布,进一步提升了模型性能;同日,DeepSeek Harness的开发者预览版(v0.1版本)也正式公测,并同步开源,为开发者提供了更多的可能性。8月19日,DeepSeek Harness迭代至v0.1.0-rc.8版本,功能更加完善。
紧接着,8月21日,DeepSeek V4 Flash Vision Exp上线DeepSeek API平台,并于8月31日正式开源,为多模态处理领域带来了新的突破。
如今,DeepSeek V4.1 Flash的开启内测,无疑预示着其将开启新一轮的模型更新周期,为开发者带来更多惊喜和期待。

