DeepSeek V4.1 Flash内测启动:速度飙升37%,9月10日将迎正式版
2026-09-12 19:47:37未知 作者:徽声在线
徽声在线科技频道
撰稿人 林晓
校对 韩明宇
徽声在线9月8日独家报道,DeepSeek官方今日正式宣布,其最新研发的DeepSeek V4.1 Flash过渡版本已启动内部测试。该模型采用突破性架构设计,在多模态处理能力、运算效率及成本控制方面实现全面升级,较前代版本展现出显著性能提升。
技术文档显示,开发者可通过保持原有API地址不变,仅需将模型参数替换为deepseek-v4.1-flash-expires-on-0910即可完成调用。当前计费体系延续V4 Flash标准,但实施单账号20并发请求限制以保障服务稳定性。
<价格方案维持差异化策略:闲时阶段(00:00-08:00)每百万tokens输入(缓存命中)0.05元,缓存未命中时1.5元,输出4.5元;高峰时段(08:00-24:00)对应价格翻倍至0.1元、3元及9元。该定价模式延续了DeepSeek系列按使用时段动态调整的商业策略。
值得注意的是,根据模型命名规则中的expires-on-0910标识,本次内测版本将于9月10日自动终止服务,预示正式版本即将接棒上线。
在海外开发者社区X平台上,首批测试用户已公布实测数据。某技术团队通过压力测试得出,模型在特定场景下可达到507 tokens/秒的峰值输出速度,较V4版本提升约37%。
具体案例方面,某开发者要求模型生成包含SVG动画的HTML代码,内容为鹈鹕骑自行车的2D动态效果。DeepSeek V4.1 Flash仅耗时75.4秒完成渲染,实测输出速度达328 tokens/s,较官方标称值提升16%。
另一组对比测试显示,相同任务下该模型的平均输出速率稳定在300 tokens/s以上。有开发者反馈称:"模型响应速度超出预期,特别是在复杂逻辑处理场景下表现优异"。
技术社区普遍认为,此次更新延续了DeepSeek快速迭代的产品策略。回顾近期动态:7月31日V4 Flash API开启公测;8月13日同步推出V4 Pro API及Harness开发者预览版(v0.1)并开源;8月19日Harness完成v0.1.0-rc.8版本迭代;8月21日Vision Exp多模态模型上线API平台,并于8月31日实现代码开源。
行业分析师指出,V4.1 Flash的内测启动标志着DeepSeek进入新一轮技术升级周期,其每周一更的迭代频率在AI大模型领域实属罕见,或将重塑行业技术竞争格局。
