DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,9月10日限时体验

2026-09-10 02:04:54未知 作者:徽声在线


徽声在线
作者 程茜
编辑 李水青

徽声在线9月8日最新报道,就在刚刚,人工智能领域迎来重要进展——DeepSeek官方正式宣布,其全新升级的DeepSeek V4.1 Flash中间版本正式启动内测。这款新模型不仅采用了创新的模型架构设计,更实现了原生多模态支持、性能显著提升、响应速度飞跃式增长以及使用成本大幅降低等多重突破。

技术团队特别说明,开发者只需保持原有base_url配置不变,将模型名称更新为deepseek-v4.1-flash-expires-on-0910即可无缝衔接调用。在计费政策方面,当前内测版本延续DeepSeek V4 Flash的定价体系,但特别设置了单账号20并发请求的流量限制,确保服务稳定性。


价格体系方面,内测版本延续差异化收费策略:空闲时段(每日0:00-8:00)每百万tokens输入(缓存命中)仅需0.05元,缓存未命中时为1.5元,输出价格为4.5元;高峰时段(8:00-24:00)对应价格为输入(缓存命中)0.1元、缓存未命中3元、输出9元。这种阶梯定价模式既保障了基础研发需求,又优化了资源分配效率。

值得注意的是,根据模型命名规则中的expires-on-0910标识,本次内测服务将于9月10日自动终止并下线,开发者需及时调整测试计划。

在社交平台X的开发者社区,首批体验者已分享惊人数据:某技术团队实测显示,模型输出速度最高可达507 tokens/秒,较前代版本提升近40%。


更具代表性的测试案例中,开发者要求模型生成包含SVG动画的HTML代码——具体需求为绘制一只鹈鹕骑自行车的2D动态效果。DeepSeek V4.1 Flash仅用时75.4秒就完成全部代码生成,实测输出速度达328 tokens/秒,且动画流畅度获得测试者高度评价。


另一位开发者进行的相同主题测试(见附图)显示,模型输出的平均速度稳定在300 tokens/秒以上,且生成的动画细节丰富,鹈鹕的羽毛纹理、自行车链条运动等细节都得到精准呈现。


早期体验者普遍反馈,新模型在代码生成、复杂逻辑处理等场景下表现出「令人震惊的加速效果」,某开发者直言:「手动接入后,这个速度简直快得离谱!」


回顾DeepSeek系列的发展轨迹,其技术迭代速度持续加快的特征尤为显著:

7月31日,DeepSeek V4 Flash正式版API率先开启公测;8月13日,性能更强的DeepSeek V4 Pro正式版API发布,同日开发者预览版DeepSeek Harness(v0.1)同步公测并开源;仅6天后(8月19日),DeepSeek Harness就迭代至v0.1.0-rc.8版本。

8月21日,具备视觉处理能力的DeepSeek V4 Flash Vision Exp上线API平台,并于8月31日完成开源;如今,距离上次更新不足半月,DeepSeek V4.1 Flash就开启内测,标志着该系列正式进入高频迭代周期

行业分析师指出,这种密集的技术更新节奏,既展现了研发团队的技术实力,也预示着人工智能大模型领域即将迎来新一轮竞争高潮。

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势 马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求马斯克明确拒绝乌克兰利用“星链”打击俄境内目标请求
相关文章
重磅!GPT-Image-2.5 震撼发布,引领图像生成新纪元重磅!GPT-Image-2.5 震撼发布,引领图像生成新纪元 DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,9月10日限时体验DeepSeek V4.1 Flash内测启动:速度飙升507 tokens/s,9月10日限时体验 AGI时代真的来临了吗?深度解析技术宣言背后的真相AGI时代真的来临了吗?深度解析技术宣言背后的真相 红果短剧日活1.68亿碾压传统平台,免费模式能否持续领跑?红果短剧日活1.68亿碾压传统平台,免费模式能否持续领跑? 苹果iPhone 18系列与折叠屏未发先热,代抢费飙升引关注苹果iPhone 18系列与折叠屏未发先热,代抢费飙升引关注 OpenAI内部模型攻克千禧年流体运动难题,不申领大奖引关注OpenAI内部模型攻克千禧年流体运动难题,不申领大奖引关注