DeepSeek新模型V4.1 Flash内测启动,网友直呼速度惊人!
2026-09-09 15:32:31未知 作者:徽声在线
徽声在线
作者 程茜
编辑 李水青
徽声在线9月8日报道,就在刚刚,DeepSeek官方对外宣布,旗下DeepSeek V4.1 Flash的中间版本正式开启内部测试。据介绍,该新模型采用了全新的架构设计,不仅原生支持多模态数据处理,而且在性能、速度以及成本控制方面都实现了显著提升。
对于开发者而言,使用方式极为简便,只需保持base_url不变,将模型名称设定为deepseek-v4.1-flash-expires-on-0910,即可轻松调用。在计费方面,当前与DeepSeek V4 Flash保持一致,每个账号限流20并发请求。
与DeepSeek V4 Flash类似,DeepSeek V4.1 Flash此次内测版本在价格上也有明确划分。在空闲时段,每百万tokens输入(缓存命中)费用为0.05元,输入(缓存未命中)费用为1.5元,输出费用为4.5元;而在高峰时段,对应价格则分别为每百万tokens输入(缓存命中)0.1元,输入(缓存未命中)3元,输出9元。
值得注意的是,从模型名称可以推断,此次内测版本将于9月10日自动过期并下线。
在社交平台X上,已经有不少开发者迫不及待地分享了自己的使用体验。其中,有开发者反馈,该模型的最高输出速度竟然达到了惊人的507 tokens/s。
一位开发者尝试让模型创建HTML代码,内容是利用SVG绘制一个鹈鹕骑自行车的2D动画。令人惊喜的是,DeepSeek V4.1Flash仅用时75.4秒就完成了任务,输出速度高达328 tokens/s。
另一位开发者也进行了同样的鹈鹕骑自行车测试,并展示了生成的效果图。他透露,该模型的输出平均速度超过了300 tokens/s。
还有网友表示,在手动添加该模型后,发现其运行速度非常快,几乎超出了预期。
回顾DeepSeek系列模型的发展历程,不难发现其近期更新迭代十分频繁。
7月31日,DeepSeek V4 Flash正式版API率先上线进行公测;紧接着,8月13日,DeepSeek V4 Pro正式版API也正式发布;同日,DeepSeek Harness的开发者预览版(v0.1版本)也开启了公测,并同步进行了开源。仅仅过了几天,8月19日,DeepSeek Harness就迭代至了v0.1.0-rc.8版本。
随后,在8月21日,DeepSeek V4 Flash Vision Exp也上线了DeepSeek API平台,并于8月31日正式开源。
如今,DeepSeek V4.1 Flash又开启了内测,这或许预示着其将开启新一轮的模型更新周期,为用户带来更多惊喜。

