重磅!DeepSeek V4.1 Flash内测开启:速度飙升,开发者实测数据惊人
2026-09-14 08:10:09未知 作者:徽声在线
徽声在线
作者 程茜
编辑 李水青
徽声在线9月8日最新报道,就在刚刚,人工智能领域迎来重要进展——DeepSeek官方正式宣布,其全新研发的DeepSeek V4.1 Flash中间版本正式启动内测。这款新模型不仅采用了创新的架构设计,更在性能上实现了显著突破,具备原生多模态支持能力、更强的综合性能、更快的处理速度以及更低的运行成本,引发业界广泛关注。
据官方技术文档显示,开发者无需修改基础调用地址(base_url),只需将模型名称配置为deepseek-v4.1-flash-expires-on-0910即可完成接入。当前计费模式延续DeepSeek V4 Flash标准,但特别设置了每账号20并发请求的限制,以确保服务稳定性。
在价格体系方面,DeepSeek V4.1 Flash内测版延续了差异化定价策略:空闲时段(00:00-08:00)每百万tokens输入(缓存命中)仅需0.05元,输入(缓存未命中)1.5元,输出4.5元;高峰时段(08:00-24:00)对应价格分别为0.1元、3元和9元。这种阶梯定价模式既满足了不同时段的使用需求,也优化了资源分配效率。
值得注意的是,根据模型命名规则中的expires-on-0910标识,此次内测版本将于9月10日自动终止服务,预计后续将推出正式版本。
在社交平台X上,首批参与内测的开发者已开始分享实测数据。其中一位开发者展示的测试结果显示,模型输出速度最高达到507 tokens/s,这一数据在同类模型中处于领先水平。
具体应用场景测试中,当要求模型生成包含SVG动画的HTML代码(内容为鹈鹕骑自行车的2D动画)时,DeepSeek V4.1 Flash仅用时75.4秒即完成任务,输出速度稳定在328 tokens/s,展现出强大的代码生成能力。
另一位开发者进行的相同主题测试也验证了模型的卓越性能,其生成的动画效果如图所示,平均输出速度超过300 tokens/s。多位参与者反馈,模型在处理复杂任务时表现出"前所未有的流畅度"。
有开发者在技术论坛分享体验时特别强调:"手动添加该模型后,其响应速度之快令人惊叹,完全超出预期",这一评价引发了社区的热烈讨论。
回顾DeepSeek系列模型的发展轨迹,其更新迭代速度持续加快,展现出强大的技术研发实力。
今年7月31日,DeepSeek V4 Flash正式版API率先开启公测;仅隔半月,8月13日便同时推出DeepSeek V4 Pro正式版API和DeepSeek Harness开发者预览版(v0.1),并实现核心代码开源;8月19日,DeepSeek Harness迅速迭代至v0.1.0-rc.8版本,完善了多项功能。
紧接着在8月21日,DeepSeek V4 Flash Vision Exp上线API平台,并于8月31日完成开源,进一步拓展了模型的多模态应用场景。
此次DeepSeek V4.1 Flash的内测启动,不仅标志着技术迭代的持续深化,更预示着该系列模型将开启新一轮的升级周期,为AI应用开发带来更多可能性。
