重磅!DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,9月10日截止
2026-09-24 23:52:09未知 作者:徽声在线
徽声在线
撰稿 程茜
审校 李水青
徽声在线9月8日独家报道,DeepSeek官方今日正式宣布,其最新研发的DeepSeek V4.1 Flash中间版本已启动内部测试。这款新模型在架构设计上实现了重大突破,不仅原生支持多模态数据处理,更在性能表现上实现了全面提升——处理速度更快、功能更强大且运营成本显著降低。
技术团队透露,开发者无需修改基础URL,只需将模型名称更新为deepseek-v4.1-flash-expires-on-0910即可完成调用。当前计费标准与DeepSeek V4 Flash保持一致,但实施了每账号20并发请求的流量限制以保障服务稳定性。
价格体系方面,内测版本延续了分级计费模式:空闲时段每百万tokens输入(缓存命中)0.05元,缓存未命中时1.5元,输出服务4.5元;高峰时段则调整为输入(缓存命中)0.1元,缓存未命中3元,输出9元。值得注意的是,所有价格均按实际使用量精确计算。
根据模型命名规则中的时间标识,本次内测版本将于9月10日自动终止服务,预计后续将推出正式商用版本。
在社交平台X上,首批参与测试的开发者已分享使用体验。实测数据显示,模型最高输出速度突破507 tokens/秒,在复杂任务处理中展现出惊人效率。
具体案例中,有开发者要求模型生成包含SVG动画的HTML代码,内容为鹈鹕骑自行车的2D动态效果。DeepSeek V4.1 Flash仅用75.4秒就完成任务,输出速度达328 tokens/秒,生成的动画流畅度获得技术社区广泛认可。
另一位开发者进行的相同测试显示,模型输出的平均速度持续保持在300 tokens/秒以上,且生成的动画细节丰富,色彩过渡自然。有参与者评价称:"添加模型后,系统响应速度超出预期,堪称指数级提升。"
<7月31日,DeepSeek V4 Flash正式版API开启公测;8月13日,V4 Pro正式版API与Harness开发者预览版(v0.1)同步发布,后者随即开源;8月19日,Harness完成v0.1.0-rc.8版本迭代;
8月21日,V4 Flash Vision Exp登陆API平台,并于8月31日实现全代码开源。此次V4.1 Flash内测的启动,预示着该系列将进入新一轮技术升级周期。
行业分析师认为,DeepSeek通过高频迭代持续优化模型性能,正在人工智能领域构建显著的技术壁垒,其多模态处理能力与成本控制水平或将重新定义行业标准。