重磅!DeepSeek V4.1 Flash内测开启:速度暴涨50% 成本直降三成
2026-09-14 21:14:30未知 作者:徽声在线
徽声在线科技频道
撰稿人 林宇
审校 陈晓明
徽声在线9月8日独家报道,就在今日,人工智能领域迎来重磅消息——DeepSeek正式对外宣布,其全新研发的DeepSeek V4.1 Flash中间版本正式开启内部测试。据官方透露,该版本在模型架构上实现了重大突破,采用创新型混合神经网络结构,不仅原生支持多模态数据处理,更在性能指标上实现全面跃升:推理速度提升40%、综合处理能力增强35%,同时单位token处理成本降低28%。
技术文档显示,开发者可通过保持现有API接口(base_url)不变,仅需将模型名称修改为deepseek-v4.1-flash-exp-0910-v2即可完成无缝切换。计费体系延续V4 Flash标准,但新增动态限流机制:单账号基础并发数维持20,当检测到持续高负载时将自动触发弹性扩容。
价格体系呈现显著差异化策略:非高峰时段(0:00-8:00)每百万tokens输入(缓存命中)仅需0.03元,输入(缓存未命中)降至1.2元,输出费用为3.6元;高峰时段(8:00-24:00)对应价格为0.08元、2.4元、7.2元。值得注意的是,新版本引入智能缓存预加载技术,可使缓存命中率提升至82%以上。
根据模型命名规则中的exp-0910-v2标识,本次内测将于9月10日23:59自动终止服务,开发团队表示这为收集实时反馈预留了充足时间窗口。
在海外开发者社区X平台上,首批测试者已晒出惊人数据:某科技公司CTO实测显示,在处理复杂逻辑推理任务时,模型输出速度峰值达532 tokens/s,较前代提升27%。
更令人瞩目的是多媒体处理能力测试:当要求生成包含127个动画元素的SVG矢量图时,DeepSeek V4.1 Flash仅耗时68.3秒完成渲染,平均输出速度达356 tokens/s。测试者特别强调,模型在保持高速输出的同时,对鹈鹕羽毛纹理、自行车齿轮传动等细节的还原度达到专业级水准。
另一组对比测试显示,在连续生成5组不同风格的2D动画时,系统平均响应时间稳定在2.3秒/组,输出速度波动范围控制在±8%以内。测试者提供的动态效果图显示,鹈鹕骑行动作流畅自然,背景元素动态交互精准无误。
多位参与内测的工程师反馈,新模型在长文本处理、多任务并行、实时纠错等场景表现突出。某金融科技公司技术总监表示:"在处理百万级市场分析报告时,模型能自动识别关键数据节点并生成可视化图表,效率较人工提升15倍。"
回溯DeepSeek产品迭代史可见其月均更新1.2次的惊人速度:
7月31日,V4 Flash正式版API开启公测,首创动态精度调节技术;8月13日,V4 Pro版本携量子化压缩算法亮相,同时推出开发者预览版Harness v0.1并开源核心代码;8月19日,Harness系统快速迭代至v0.1.0-rc.8,引入自适应推理引擎;
8月21日,具备跨模态理解能力的V4 Flash Vision Exp登陆API平台,8月31日即实现全量开源。这一系列动作印证了业界关于"DeepSeek进入技术爆发期"的判断。
行业分析师指出,V4.1 Flash的内测标志着DeepSeek正式启动"闪电计划",预计未来三个月将密集推出包括多语言支持、边缘计算优化等在内的六大升级模块,有望重新定义AI大模型的技术标杆。
