DeepSeek 发布 V4.1 Flash 模型:全面超越 V4 Pro,旧版将于 9 月 14 日停用

DeepSeek 推出新一代 V4.1 Flash 模型,全面替代 V4 Pro 与早期 Flash 版本,9 月 14 日起旧版请求自动路由至新模型。

新模型正式发布:V4.1 Flash 成为主力

DeepSeek 正式推出 DeepSeek V4.1 Flash 模型,作为其新一代主力推理模型。以下为关键事实:

  • 发布时间:2026 年 9 月(文档发布于 9 月 11 日)
  • 新模型名称deepseek-flash(推荐名称);旧名 deepseek-v4-flashdeepseek-v4-flash-vision-exp 仍在兼容范围内,但语言模型已停用
  • 旧版归档:V4 Pro (deepseek-v4-pro) 将于 2026 年 9 月 14 日 12:00 北京时间起停用,所有请求自动路由至 V4.1 Flash
  • 计价标准:旧版请求按 V4.1 Flash 的 Flash 价格计费;V4 Pro 停用后统一按 Flash 价格结算
  • 服务方式:API 兼容 OpenAI/Anthropic 格式,支持流式与非流式调用

V4.1 Flash 不仅在性能上超越 V4 Pro, also 在成本控制、响应速度与总耗时方面实现全面优化,标志着 DeepSeek 推理能力进入新阶段。

技术实现与 API 接入细节

V4.1 Flash 采用与 OpenAI/Anthropic API 兼容的请求格式,现有 SDK 仅需修改模型名称即可无缝接入。其核心调用参数包括 model: "deepseek-flash"reasoning_effort: "high" 以及 OpenAI 风格的 messages 结构。值得注意的是,模型支持 thinking: {"type": "enabled"} 以启用连续思考模式,这是 DeepSeek 特有的推理增强机制。

当前 SDK 示例覆盖 curl、Python 和 Node.js 三类主流语言,均需设置 baseURL: "https://api.deepseek.com" 并通过环境变量注入 API Key。以 Python 为例,初始化客户端后仅需调用 client.chat.completions.create() 并额外传入 extra_body={"thinking": {"type": "enabled"}} 即可激活高级推理能力。

关键事实:尽管 V4.1 Flash 在各项指标上超越 V4 Pro,但 DeepSeek 明确表示 V4.1 Pro 尚未发布——当前停用 V4 Pro 是临时过渡方案,待后续 V4.1 Pro 正式推出后将重新路由。

模型能力对比表

模型版本推荐 API 名称当前状态停用时间计费标准
V4.1 Flashdeepseek-flash正式可用Flash 价格
V4 Flash (旧版)deepseek-v4-flash兼容但已停用1已停用(路由至 V4.1 Flash)Flash 价格
V4 Flash Vision`deepseek-v4-flash-vision-exp``兼容但已停用1已停用(路由至 V4.1 Flash)Flash 价格
V4 Prodeepseek-v4-pro暂维持服务2026-09-14 12:00 (BJT)Flash 价格

注 1:文档明确旧 Flash 版本已停用,其请求由 V4.1 Flash 承载。

开发者落地建议

需立即行动的用户

  • 正在使用 deepseek-v4-flashdeepseek-v4-flash-vision-expdeepseek-v4-pro 的项目,建议在 9 月 14 日前完成模型名称更新至 deepseek-flash
  • 若依赖较旧的 SDK 或工具链,需确认其是否支持 thinkingreasoning_effort 参数

建议再观察的用户

  • 若当前业务对 V4 Pro 的推理能力有强依赖,可短时等待 V4.1 Pro 的正式发布,以获得更稳定的长期方案
  • 临时测试型调用可继续使用旧 API,但务必了解 9 月 14 日后费用将按 Flash 标准计收

写在最后

DeepSeek 此次快速迭代揭示了推理模型市场竞争已进入"性能-成本-延迟"三维竞速阶段。新模型不设过渡期直接替换旧版,反映出厂商对模型稳定性的高度信心,也倒逼开发者加速适配节奏。