Featured image of post DeepSeek测试V4.1 Flash版本,试探能否全面替代Pro版

DeepSeek测试V4.1 Flash版本,试探能否全面替代Pro版

DeepSeek启动内部测试,评估中间版V4.1 Flash能否全面替代现有V4 Pro模型

DeepSeek启动V4.1 Flash内部测试,价格同步下调

DeepSeek于2026年9月启动一次有限的内部测试,推出中间版本的V4.1 Flash模型,并在反馈表中明确询问用户该版本 是否能够全面替代现行的V4 Pro在线版。与此同时,公司于北京时间9月10日中午下调Flash系列定价,最大降幅达60%。若测试验证成功,DeepSeek将重构其模型部署策略:基础与中等复杂度任务向低成本Flash迁移,Pro保留用于真正困难场景

核心信息要点

核心信息要点
核心信息要点|新闻截图

  • 发布时间:2026年9月初启动内部测试,测试版本模型名称有效期至9月10日
  • 新版本:V4.1 Flash中间检查点(intermediate checkpoint),非最终商用版本
  • 关键特性:采用新架构,原生支持多模态,相较前代Flash提升能力、速度与成本效率
  • 价格调整:北京时间9月10日12:00生效;测试期间按现有V4 Flash费率计费
  • 使用限制:每个账号最多20个并发请求
  • 权重开放:材料未提及权重是否开源

测试细节与技术进展

测试细节与技术进展
测试细节与技术进展|新闻截图

V4.1 Flash在内部测试中展现出更为突出的生成速度表现,开发者初步反馈特别强调其在编码与检索任务上的生成速度显著提升。技术层面,该版本引入新结构并实现原生多模态支持——指模型无需额外适配层即可直接处理图像、文本等多元输入。尽管此次测试限于内部用户群体,但已出现关于性能提升的明确正向报告。

与此同时,DeepSeek同步宣布Flash系列价格调整方案。最大降幅出现在缓存命中输入环节,降幅高达60%。具体调价方案如下:

规格缓存命中输入缓存未命中输入输出
非高峰价(元/百万token)0.021.004.00
高峰价(元/百万token)0.042.008.00

此价格表适用于主Flash模型及浪溅实验版本(vision-experimental variant),二者同步调价。对比此前峰值阶段9元/百万token的输出费率,当前4元/200万元的输出成本已大幅优化。意料之外的是:Flash版本的缓存命中输入费率降至张/百万token,仅为主版本同等场景成本的一小部分,构成历史上最悬殊的价差之一。

性价比逻辑:密集智能的新竞争维度

性价比逻辑:密集智能的新竞争维度
性价比逻辑:密集智能的新竞争维度|新闻截图

DeepSeek在材料中反复强调的"intelligence density"(智能密度)概念,在本次迭代中体现为更短停顿时间、更少中间推理步骤与更低每美元产出质量的综合优势。智能密度指单位时间与单位成本下模型输出有效答案的能力。对Agent类应用场景而言,单次用户请求可能触发多次模型调用——涉及文件读取、工具调用、中间结果校验与多步推动。此时低tokencost未必对应低成本任务,反因步骤膨胀推高总消耗。DeepSeek的开放式Harness框架正属此层优化:模型负责决策,Harness提供工具集成、会话状态管理与执行环境支撑。

行业观察显示,同类策略亦见于其他前沿实验室:当中间档模型逼近上代旗舰性能时,高端版本需转向更长周期、更高风险任务(如数小时以上的Agentic工作流)以证明溢价合理性。旗舰模型的竞争重心正从单一基准分转向能否在数小时甚至数日内稳定完成可验证的复杂任务链

产品选择建议

  • 适合选择Flash的用户:日常推理、代码生成、文档检索、中等复杂度会话任务;对延迟敏感且希望降低单次响应成本的场景
  • 建议暂等或继续使用Pro的场景:需严格多步骤认证的决策支持、超长上下文一致性维持、需要可追溯完整推理链的专业领域任务(如金融建模、法律论证)

写在最后:DeepSeek本次行动标志着其从"能力可得性"向"效率可负担性"的战略转向。当强推理能力已泛化,下一个竞争维度将是每毫秒延迟、每分钱成本所能承载的有效智能密度。Flash能否真正吸收主流负载,或将重塑整个开源与闭源模型的价格分层格局。