DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,多模态能力全面升级

2026-09-13 07:25:40未知 作者:徽声在线


徽声在线
作者 程茜
编辑 李水青

据徽声在线9月8日最新报道,DeepSeek官方今日正式宣布,旗下DeepSeek V4.1 Flash的中间测试版本已启动内测程序。这款新模型在架构层面实现了重大突破,不仅原生支持多模态交互,还在性能、速度和成本控制方面实现了全面提升,引发开发者社区广泛关注。

技术文档显示,开发者可通过保持现有base_url不变,将模型名称替换为deepseek-v4.1-flash-expires-on-0910即可完成调用。当前计费体系延续DeepSeek V4 Flash标准,但新增单账号20并发请求限制,以保障服务稳定性。


价格体系方面,内测版延续差异化定价策略:空闲时段(00:00-08:00)每百万tokens输入(缓存命中)0.05元,输入(缓存未命中)1.5元,输出4.5元;高峰时段(08:00-24:00)对应价格翻倍,分别为0.1元、3元和9元。值得注意的是,该内测版本将于9月10日自动终止服务

在性能实测环节,社交平台X上的开发者反馈显示,模型输出速度表现惊艳。某开发者测试显示,最高输出速度达507 tokens/s,较前代版本提升显著。


具体应用场景测试中,当要求模型生成包含SVG动画的HTML代码(内容为鹈鹕骑自行车的2D动画)时,DeepSeek V4.1 Flash仅用时75.4秒即完成任务,输出速度稳定在328 tokens/s


另一位开发者分享的测试结果进一步验证了模型性能,其生成的动画效果图显示,在相同测试任务下,平均输出速度持续保持在300 tokens/s以上,且动画流畅度获得好评。


用户反馈层面,多位开发者强调模型响应速度的质的飞跃。有开发者表示:"手动接入模型后,其处理速度远超预期,特别是在复杂任务场景下表现尤为突出。"


回顾DeepSeek系列模型发展轨迹,其技术迭代速度持续加快。今年7月31日,DeepSeek V4 Flash正式版API率先开启公测;8月13日,V4 Pro正式版API与Harness开发者预览版(v0.1)同步发布,并实现核心代码开源;8月19日,Harness快速迭代至v0.1.0-rc.8版本;8月21日,V4 Flash Vision Exp上线API平台,并于8月31日完成开源。

行业分析师指出,此次V4.1 Flash内测版的推出,不仅延续了DeepSeek每月重大更新的技术迭代节奏,更预示着其将开启以多模态为核心的新一轮模型升级周期,有望在AI应用层引发新的创新浪潮。

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势
相关文章
DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,多模态能力全面升级DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,多模态能力全面升级 AGI 何时真正降临?深度剖析与展望AGI 何时真正降临?深度剖析与展望 红果短剧日活1.68亿超“爱优腾芒”总和,人均每天看125分钟红果短剧日活1.68亿超“爱优腾芒”总和,人均每天看125分钟 OpenAI突破千禧年难题:纳维-斯托克斯方程获新解OpenAI突破千禧年难题:纳维-斯托克斯方程获新解 理想i9发布日期确定:9月16日李想亲述期待理想i9发布日期确定:9月16日李想亲述期待 对话帕西尼创始人许晋诚:人形机器人工厂应用加速,灵巧手寿命提升有妙招对话帕西尼创始人许晋诚:人形机器人工厂应用加速,灵巧手寿命提升有妙招