新模型正式发布:V4.1 Flash 成为主力
DeepSeek 正式推出 DeepSeek V4.1 Flash 模型,作为其新一代主力推理模型。以下为关键事实:
- 发布时间:2026 年 9 月(文档发布于 9 月 11 日)
- 新模型名称:
deepseek-flash(推荐名称);旧名deepseek-v4-flash与deepseek-v4-flash-vision-exp仍在兼容范围内,但语言模型已停用 - 旧版归档:V4 Pro (
deepseek-v4-pro) 将于 2026 年 9 月 14 日 12:00 北京时间起停用,所有请求自动路由至 V4.1 Flash - 计价标准:旧版请求按 V4.1 Flash 的 Flash 价格计费;V4 Pro 停用后统一按 Flash 价格结算
- 服务方式:API 兼容 OpenAI/Anthropic 格式,支持流式与非流式调用
V4.1 Flash 不仅在性能上超越 V4 Pro, also 在成本控制、响应速度与总耗时方面实现全面优化,标志着 DeepSeek 推理能力进入新阶段。
技术实现与 API 接入细节
V4.1 Flash 采用与 OpenAI/Anthropic API 兼容的请求格式,现有 SDK 仅需修改模型名称即可无缝接入。其核心调用参数包括 model: "deepseek-flash"、reasoning_effort: "high" 以及 OpenAI 风格的 messages 结构。值得注意的是,模型支持 thinking: {"type": "enabled"} 以启用连续思考模式,这是 DeepSeek 特有的推理增强机制。
当前 SDK 示例覆盖 curl、Python 和 Node.js 三类主流语言,均需设置 baseURL: "https://api.deepseek.com" 并通过环境变量注入 API Key。以 Python 为例,初始化客户端后仅需调用 client.chat.completions.create() 并额外传入 extra_body={"thinking": {"type": "enabled"}} 即可激活高级推理能力。
关键事实:尽管 V4.1 Flash 在各项指标上超越 V4 Pro,但 DeepSeek 明确表示 V4.1 Pro 尚未发布——当前停用 V4 Pro 是临时过渡方案,待后续 V4.1 Pro 正式推出后将重新路由。
模型能力对比表
| 模型版本 | 推荐 API 名称 | 当前状态 | 停用时间 | 计费标准 |
|---|---|---|---|---|
| V4.1 Flash | deepseek-flash | 正式可用 | 无 | Flash 价格 |
| V4 Flash (旧版) | deepseek-v4-flash | 兼容但已停用1 | 已停用(路由至 V4.1 Flash) | Flash 价格 |
| V4 Flash Vision | `deepseek-v4-flash-vision-exp`` | 兼容但已停用1 | 已停用(路由至 V4.1 Flash) | Flash 价格 |
| V4 Pro | deepseek-v4-pro | 暂维持服务 | 2026-09-14 12:00 (BJT) | Flash 价格 |
注 1:文档明确旧 Flash 版本已停用,其请求由 V4.1 Flash 承载。
开发者落地建议
需立即行动的用户:
- 正在使用
deepseek-v4-flash、deepseek-v4-flash-vision-exp或deepseek-v4-pro的项目,建议在 9 月 14 日前完成模型名称更新至deepseek-flash - 若依赖较旧的 SDK 或工具链,需确认其是否支持
thinking与reasoning_effort参数
建议再观察的用户:
- 若当前业务对 V4 Pro 的推理能力有强依赖,可短时等待 V4.1 Pro 的正式发布,以获得更稳定的长期方案
- 临时测试型调用可继续使用旧 API,但务必了解 9 月 14 日后费用将按 Flash 标准计收
写在最后
DeepSeek 此次快速迭代揭示了推理模型市场竞争已进入"性能-成本-延迟"三维竞速阶段。新模型不设过渡期直接替换旧版,反映出厂商对模型稳定性的高度信心,也倒逼开发者加速适配节奏。