DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,多模态能力全面升级
2026-09-13 07:25:40未知 作者:徽声在线
徽声在线
作者 程茜
编辑 李水青
据徽声在线9月8日最新报道,DeepSeek官方今日正式宣布,旗下DeepSeek V4.1 Flash的中间测试版本已启动内测程序。这款新模型在架构层面实现了重大突破,不仅原生支持多模态交互,还在性能、速度和成本控制方面实现了全面提升,引发开发者社区广泛关注。
技术文档显示,开发者可通过保持现有base_url不变,将模型名称替换为deepseek-v4.1-flash-expires-on-0910即可完成调用。当前计费体系延续DeepSeek V4 Flash标准,但新增单账号20并发请求限制,以保障服务稳定性。
价格体系方面,内测版延续差异化定价策略:空闲时段(00:00-08:00)每百万tokens输入(缓存命中)0.05元,输入(缓存未命中)1.5元,输出4.5元;高峰时段(08:00-24:00)对应价格翻倍,分别为0.1元、3元和9元。值得注意的是,该内测版本将于9月10日自动终止服务。
在性能实测环节,社交平台X上的开发者反馈显示,模型输出速度表现惊艳。某开发者测试显示,最高输出速度达507 tokens/s,较前代版本提升显著。
具体应用场景测试中,当要求模型生成包含SVG动画的HTML代码(内容为鹈鹕骑自行车的2D动画)时,DeepSeek V4.1 Flash仅用时75.4秒即完成任务,输出速度稳定在328 tokens/s。
另一位开发者分享的测试结果进一步验证了模型性能,其生成的动画效果图显示,在相同测试任务下,平均输出速度持续保持在300 tokens/s以上,且动画流畅度获得好评。
用户反馈层面,多位开发者强调模型响应速度的质的飞跃。有开发者表示:"手动接入模型后,其处理速度远超预期,特别是在复杂任务场景下表现尤为突出。"
回顾DeepSeek系列模型发展轨迹,其技术迭代速度持续加快。今年7月31日,DeepSeek V4 Flash正式版API率先开启公测;8月13日,V4 Pro正式版API与Harness开发者预览版(v0.1)同步发布,并实现核心代码开源;8月19日,Harness快速迭代至v0.1.0-rc.8版本;8月21日,V4 Flash Vision Exp上线API平台,并于8月31日完成开源。
行业分析师指出,此次V4.1 Flash内测版的推出,不仅延续了DeepSeek每月重大更新的技术迭代节奏,更预示着其将开启以多模态为核心的新一轮模型升级周期,有望在AI应用层引发新的创新浪潮。
