DeepSeek V4.1 Flash 即将上线:过渡期请求自动切换,Flash 价格下调 60%

DeepSeek 开放平台宣布将于 2026 年 9 月 10 日前后发布 V4.1 Flash,并在过渡期将 V4 Pro 请求路由至新模型。同日中午起,Flash 系列降价约 60%,缓存命中价格降至 0.04 元。

DeepSeek 开放平台近日在「用量信息」页面发布通知称,计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型。更受开发者关注的是,官方同时宣布自 9 月 10 日中午 12 点起调整 Flash 系列价格,其中核心调用价格较此前下降约 60%。这一变化距离 8 月中旬的一轮涨价仅过去约三周,也让国产大模型 API 市场的价格竞争再次升温。

过渡期内调用 V4 Pro,实际路由至 V4.1 Flash

根据 DeepSeek 开放平台公告,官方表示经过内部与外部多方测试,V4.1 Flash 在性能、费用、速度和总用时等指标上已经全面超越 V4 Pro。

为了让现有开发者平稳过渡,DeepSeek 设定了一个特殊阶段:在 V4.1 Flash 正式上线之后、V4.1 Pro 上线之前,平台将把原本发往 V4 Pro 的请求全部路由至 V4.1 Flash,并按照 V4.1 Flash 的单价计费。

这意味着,对于已经接入 DeepSeek API 的开发者而言,即使接口仍然调用 V4 Pro,实际运行的模型已经切换为新的 Flash 版本,而计费也会同步切换到更低价格。官方同时提醒,如果开发者在 V4 Pro 与 V4.1 Flash 的对比测试中发现问题,可以及时向平台反馈。

Flash 降价 60%,缓存命中价格明显回落

除了模型切换,价格调整是本次公告中的另一项重点。按照通知,自北京时间 9 月 10 日中午 12 点起,Flash 系列将迎来新一轮调价。

  • 高峰时段为周一至周五 9:00–12:00、14:00–18:00,价格将为闲时的 2 倍。
  • 缓存命中场景下,高峰时段价格同步降至 0.04 元。
  • 缓存命中与缓存未命中的输入价格均回到涨价前水平。
  • 输出价格仍为 4 元,低于此前涨价后的水平,但高于涨价前的 2 元。

从实际使用成本来看,不同调用结构的受益程度并不相同。对于长对话、Agent 任务等需要反复携带相同上下文的场景,缓存命中往往占据较大成本比例,因此这次降价带来的节省会更加明显。相反,如果应用主要成本集中在生成输出环节,由于输出价格从 4.5 元降至 4 元,整体下降约 11%,开发者的体感降幅会相对有限。

值得注意的是,这轮降价发生在 8 月中旬涨价之后不久。此前,DeepSeek 曾上调 Flash 系列价格,而此次调整后,输入侧价格已经回落至涨价前水平。对于依赖高并发、多轮调用和缓存机制的团队来说,成本压力将明显缓解。

内测版提前出现:原生多模态成为关键信号

在正式公告发布之前,DeepSeek 已经在官方交流群中启动了 V4.1 Flash 中间版本的内测。9 月 8 日下午,部分开发者可以通过原有 base_url 直接调用新的临时测试端点,只需将模型名替换为 deepseek-v4.1-flash-expires-on-0910

该端点的命名方式也表明其临时性质:模型将于 9 月 10 日到期,计费与现有 deepseek-v4-flash 相同,每个账号限制 20 路并发。

官方对内测版本的描述包括新的模型结构、原生多模态、更强能力、更快速度和更低成本。有网友实测称,输出速度可以达到 350 tokens/s 以上。虽然这一数据来自第三方测试,尚未得到官方确认,但已引发开发者对新版 Flash 推理效率的关注。

相比速度,原生多模态可能是更具长期意义的变化。此前于 8 月 21 日上线的 DeepSeek-V4-Flash-Vision-Exp,仍然属于相对独立的视觉实验分支。在 API 层面,deepseek-v4-flashdeepseek-v4-flash-vision-exp 是两个独立模型,前者无法读取图像。

而 V4.1 Flash 被官方描述为具备「原生多模态支持」。如果正式版延续这一设计,视觉能力可能被整合进基础模型本身,而不是继续以单独实验分支的方式提供。这将改变开发者调用多模态能力的方式,也可能降低应用侧维护多个模型端点的复杂度。

不过,截至目前,DeepSeek 尚未公布 V4.1 Flash 的技术报告、参数规模、架构细节以及公开评测成绩。所谓「新的模型结构」具体指向何处,仍是本次更新中尚未揭晓的部分。

价格回落背后:国产模型 API 竞争加剧

官方给出的解释是模型迭代带来成本下降,但市场环境同样不容忽视。近期国产大模型 API 竞争持续升温,各家厂商在性能、价格和推理效率之间不断调整策略。对于开发者而言,模型能力差距逐渐缩小后,价格与稳定性正成为选择 API 的重要标准。

素材中提到,有开发者认为大模型市场目前几乎没有明显护城河,许多团队会基于价格和实际效果切换服务商。此前涨价后,部分用户转向其他模型或订阅服务,而此次快速回调价格,也被视为 DeepSeek 对开发者流失压力的一次回应。

对于开发者来说,DeepSeek V4.1 Flash 的意义不仅在于单次降价,更在于其可能带来的调用策略变化:如果 Flash 版本在性能上确实能够超过 V4 Pro,且价格更低、速度更快,那么原本依赖高阶模型的部分场景,可能会重新评估是否有必要继续使用更昂贵的 Pro 系列。

随着 9 月 10 日正式发布时间临近,V4.1 Flash 的实际表现、价格优势以及原生多模态能力,将成为观察国产大模型 API 市场下一步竞争的重要样本。

原创文章,作者:点点,如若转载,请注明出处:https://www.dian8dian.com/deepseek-v4-1-flash-ji-jiang-shang-xian-guo-du-qi-qing-qiu

Like (0)
点点的头像点点
Previous 7小时前
Next 5小时前

相关推荐