DeepSeek Harness正式亮相
DeepSeek Harness(DSH)已正式发布并开源,核心看点不是又多了一个编码Agent界面,而是DeepSeek把模型运行、工具调用、上下文管理和插件生态都放进了一套可改造的框架里。
从体验看,DSH目前主要通过Web UI使用:开发者可在已安装Node.js工具链的环境中用npx @deepseek-ai/dsh web快速启动,也可以从GitHub仓库拉取源码安装。首次进入需要配置模型API Key,既可以接入DeepSeek开发平台,也支持接入其他模型。需要注意的是,原文提到DeepSeek API在17日将涨价,尤其是缓存相关费用,因此DSH在界面底部提供了Token消耗、缓存命中率等统计,方便用户控制成本。
四类预设与开发者体验
DSH启动会话前,需要选择工作目录和Agent预设。官方当前提供四类预设:
- 标准模式:包含文件编辑、Shell、检索、Skills、计划模式、目标追踪、子代理和工作流等能力。
- PTC模式:在标准模式上加入Code Mode SDK,让模型可编写TypeScript程序组合多步操作。
- 极简模式:仅保留bash和
str_replace_editor两个工具,适合基准测试和最小复现。 - 创造模式:面向插件实验、运行时检查和自定义预设创作。
其中,Agent可理解为能调用工具、拆解任务并持续执行的AI程序;Skills则更接近一组可复用提示词和流程规范。DSH内置了一批面向开发的Skill,例如代码审查、寻找可简化代码、文档规范检查和全仓库文字质量控制等。
原文作者在内测体验中提到,DSH相较部分主流编码Agent的差异在于,当用户指令不明确时,它会主动追问并给出建议选项,而不是直接交付一个半成品。同时,DSH提供“轨迹”功能,可查看Agent执行过程中的原始事件记录,帮助用户定位模型在哪一步出错、每个环节消耗了多少资源。
可插拔架构是最大变化
DSH真正的技术重点在于Cordis。按照原文的比喻,Cordis像乐高底板:开发者不是从零搭建Agent运行时,而是在一块标准底板上插入模型、工具、策略、存储和上下文管理等插件。
这带来两个直接结果。第一,DSH官方已经内置100多个插件,并预留了Plugin Store,未来社区可以继续扩展。第二,开发者若需要新功能或想替换现有能力,可以按规则编写插件接入,而不是只能在封闭核心外部增加“挂件”。
原文将这种路线称为“Agent时代的安卓”:它不追求把所有能力固化在一个高度一体化的核心中,而是把可组合、可替换、可复用放在第一位。与此相对,部分主流Agent框架更接近封闭系统,核心能力可控性更强,但社区修改主干的空间较小。
实测反馈与当前短板
在作者的对比体验中,DSH搭配DeepSeek自家模型跑长程任务时表现更积极,能在简单指令下持续探索、返工和完善。例如生成3D白模或第一人称射击游戏Demo时,DSH路径下的模型会花更长时间推进任务,而不是很快结束并交付初稿。原文也提到,社区中有人反馈Agent最长运行到10小时。
不过,DSH仍有明显待补齐之处。它目前没有Electron桌面App,需通过浏览器访问;经典Agent界面中常见的右侧栏、内置浏览器、文件管理和预览等交互细节还不完整。图片附件上传虽已支持,但若使用的模型本身不具备多模态能力,还需要另行搭配多模态模型。
行业判断:开放生态才刚开始
DSH的意义不只在于提升一次编码体验,而在于DeepSeek试图把Agent运行时变成一个社区可共同维护的基础设施。所谓“自进化”,在这里并不是模型自动变强的空泛口号,而是让大量用户和开发者在真实任务中写插件、改流程、修问题,再把可复用成果沉淀进生态。
短期看,普通用户未必马上感受到Cordis带来的差异,毕竟插件生态需要时间积累;但对极客和工具开发者来说,DSH已经给出了一个明确方向:未来Agent竞争不只比模型能力,也比谁能形成更开放、更可组合、更低成本迭代的运行时生态。




