核心事件
DeepSeek于2025年12月1日发布DeepSeek-V3.2与DeepSeek-V3.2-Speciale,两款模型定位为面向智能体的“推理优先”大语言模型,并同步开放模型与技术报告。
这次发布可以看作DeepSeek-V3.2-Exp之后的一次正式迭代:V3.2已上线DeepSeek App、Web与API,面向日常使用;V3.2-Speciale暂时仅通过API提供,重点展示更强推理能力,供社区评测与研究。
两个版本:日常可用与极限推理
DeepSeek将V3.2称为V3.2-Exp的正式继任者,强调在推理能力与输出长度之间取得平衡。官方表述称,V3.2可作为“日常主力模型”,性能达到GPT-5级别。
V3.2-Speciale则被描述为推理能力拉满的版本,官方称其表现可与Gemini-3.0-Pro竞争。DeepSeek还表示,该版本在多个高难度竞赛场景中达到金牌级结果,包括IMO、CMO、ICPC World Finals与IOI 2025。
关键信息包括:
- V3.2:App、Web、API均可用;
- V3.2-Speciale:暂为API-only;
- V3.2-Speciale:复杂任务更强,但需要更高token用量;
- V3.2-Speciale:当前不支持工具调用;
- 两个模型及技术报告均在Hugging Face开放。
这里的token可理解为模型处理文本的基本计量单位,输入和输出越长,消耗通常越多。DeepSeek特别提示Speciale版本需要更高token用量,意味着它更适合研究、评测和高难推理任务,而不一定是所有场景下的低成本选择。
面向智能体:把“思考”接入工具使用
本次更新的另一个重点,是DeepSeek提出“Thinking in Tool-Use”。所谓工具使用,是指模型在回答过程中调用外部工具或接口完成检索、计算、执行代码等任务;智能体则是在目标驱动下规划步骤、调用工具并反馈结果的系统形态。
DeepSeek称,V3.2引入一种大规模智能体训练数据合成方法,覆盖1800多个环境与8.5万多条复杂指令。这意味着模型训练不仅围绕静态问答展开,也更强调在复杂环境中分解任务、选择工具和完成多步操作。
按照官方说明,DeepSeek-V3.2是其首个将“思考”直接整合进工具使用流程的模型,并且支持在思考模式和非思考模式下进行工具调用。对开发者而言,这类能力的意义在于:模型不只是给出答案,还可能更清楚地组织调用工具前后的推理路径,从而提升复杂任务执行的可控性。
不过,官方同时注明V3.2-Speciale目前不支持工具调用。这也说明DeepSeek将两条路线暂时分开:V3.2侧重可落地的智能体能力,Speciale侧重极限推理评测。
API与开源安排
在API方面,V3.2沿用V3.2-Exp的使用模式。V3.2-Speciale则通过临时端点提供,base_url为“https://api.deepseek.com/v3.2_speciale_expires_on_20251215”。官方称其价格与V3.2相同,但无工具调用能力,开放时间截至2025年12月15日15:59(UTC)。
DeepSeek还提供了“Thinking Mode Guide”作为API文档的一部分,说明V3.2如何支持工具使用中的思考模式。对于已经围绕V3.2-Exp或DeepSeek API构建应用的开发者来说,迁移成本可能相对可控,但具体调用方式仍需以官方文档为准。
开源方面,DeepSeek在Hugging Face发布了DeepSeek-V3.2、DeepSeek-V3.2-Speciale与技术报告。这延续了其以开放模型吸引开发者、研究者和第三方评测机构参与验证的策略。
行业观察
V3.2的发布显示,开源大模型竞争正在从单纯的聊天与基准分数,转向“推理能力+智能体执行”的组合。对普通用户来说,模型是否更会解题、写代码或长程规划,最终会体现在应用体验上;对开发者来说,工具调用、token成本、API稳定性和可评测性同样关键。
更值得关注的是,DeepSeek没有把最强推理版本直接包装成通用入口,而是以临时API形式开放Speciale。这种做法既能让社区测试其上限,也避免把高token消耗模型误用到所有日常场景。接下来,开放模型阵营的焦点很可能继续围绕三件事展开:更强推理、更低推理成本,以及更可靠的智能体工作流。




