新版R1正式上线
DeepSeek在2025年5月28日发布DeepSeek-R1-0528,称该版本带来基准测试表现提升、前端能力增强、幻觉减少,并新增对JSON输出与函数调用的支持。用户可以通过chat.deepseek.com体验新版模型,开发者则可继续按原有API方式使用,官方文档入口为“Thinking Mode Guide - API Docs”。同时,DeepSeek也在Hugging Face开放了DeepSeek-R1-0528权重。
这次发布信息本身较为简洁,没有披露具体榜单分数、训练数据规模、模型参数量或推理成本变化。因此,对普通技术读者而言,更值得关注的是DeepSeek明确点出的几个方向:推理能力继续迭代、模型从聊天走向更稳定的开发与工具场景。
四项变化指向实际可用性
根据官方页面,DeepSeek-R1-0528的主要更新可概括为四点:
- Improved benchmark performance:基准表现提升,但官方未列出具体测试集和分数。
- Enhanced front-end capabilities:前端能力增强,意味着模型在网页界面、组件结构、样式与交互代码等任务上可能更贴近开发需求。
- Reduced hallucinations:减少幻觉。幻觉指模型生成看似合理但并不真实或无法验证的信息,是大模型在问答、代码解释、资料整理中常见问题。
- Supports JSON output & function calling:支持JSON输出和函数调用。JSON是一种常用结构化数据格式;函数调用则是让模型按约定格式触发外部工具或业务接口的机制。
其中,JSON输出与函数调用尤其关键。过去,许多大模型在面向应用集成时,最大挑战不是“能不能回答”,而是“能不能稳定按机器可读格式回答”。一旦模型输出结构不稳定,后端系统就需要额外解析、纠错和兜底。官方将这两项列为更新点,说明R1-0528不仅面向聊天体验,也在强化面向开发者和智能体应用的接口友好性。
API不变降低迁移成本
DeepSeek强调“No change to API usage”,即API使用方式没有变化。对于已经接入DeepSeek推理能力的开发者和企业来说,这一点意味着迁移成本相对可控:现有调用逻辑、鉴权方式和接口路径理论上不需要因为版本更新而大幅改造。官方同时给出API文档入口,提示开发者可继续参考思考模式相关指南。
开源权重同样是这次发布中的重要信息。DeepSeek-R1-0528权重在Hugging Face上线,意味着研究者和开发者可以在符合相关许可和平台规则的前提下获取模型资源,用于评测、复现或进一步实验。对大模型生态而言,开放权重通常有助于外部社区验证能力边界,也能推动围绕模型的工具链、部署方案和应用样例增长。
需要注意的是,官方页面没有说明此次开放权重对应的部署硬件需求、量化版本、上下文长度或商业使用细则;这些内容仍需以Hugging Face页面和DeepSeek后续文档为准。
相关产品线显示持续迭代节奏
在该新闻页面的相关内容中,DeepSeek还列出了DeepSeek-V3-0324、DeepSeek-V3.1以及DeepSeek-V3.1-Terminus等版本信息。页面描述显示,V3-0324强调推理性能、前端开发技能和工具使用能力;V3.1引入混合Think与Non-Think推理、更快思考、更强智能体能力、Anthropic API支持和128K上下文;V3.1-Terminus则聚焦语言一致性、减少中英文混杂,并升级Code Agent与Search Agent表现。
这些相关信息表明,DeepSeek的产品迭代重点并不只在单一聊天模型,而是在推理、代码、工具使用、智能体和API兼容性之间持续推进。对于用户来说,R1-0528更像是R1系列在推理与应用落地之间的一次补强;对于开发者来说,函数调用、结构化输出和稳定API是把模型接入业务流程的基础能力。
行业观察:从“会推理”走向“可集成”
大模型竞争正在从单纯追逐榜单,转向更看重真实应用中的稳定性、可控性和集成成本。DeepSeek-R1-0528的发布没有给出大量新指标,但它强调的方向十分清晰:减少幻觉、增强前端能力、支持结构化输出和函数调用。这些更新都服务于一个目标——让模型更容易进入开发工具、智能体系统和企业应用。
接下来,市场对这类推理模型的评价可能会更依赖实际场景测试,而不仅是官方基准描述。能否稳定生成可执行代码、能否按JSON约束输出、能否在调用外部工具时保持上下文一致,将直接影响开发者采用意愿。DeepSeek选择保持API用法不变并开放权重,有助于降低试用门槛;但模型能力究竟提升多少,仍需要社区和开发者在真实任务中验证。


