2026 最新 DeepSeek Harness 使用教程!(附保姆级安装步骤+5 个实测案例) - 知乎
DeepSeek Harness 开源短短 2 天,现在已拿下近 100k 个 Star。非常猛,照这个增速下去,说不定真有机会超过 OpenClaw 的 Star 数,哈哈。
Harness 这个词听起来可能有点陌生。简单来说,模型是大脑,Harness 就是模型的身体。所谓的 Agent,可以先粗略理解成「LLM + Harness」。
以前我们用 DeepSeek 模型,大多是把它接入其他 Agent。这次 DeepSeek 自己下场,做了一套给自家模型用的 Agent 框架。
https://www.deepseek.com/harness/
而且 DeepSeek Harness 的设计理念也非常酷,就五个字,一切皆插件。
怎么理解「一切皆插件」呢?DeepSeek Harness 里的模型、工具、策略、存储、沙箱、上下文管理和 UI 等能力,都像积木一样可以拆装。这套架构设计得很牛逼,自由度确实很高。
能让 AI 动手的就让 AI 动手,我们要成为 AI Native。直接打开你常用的 Agent,把下面这句话发给它就行了。
|
|
我这次大概花了 5 分钟就安装好了。安装完之后,执行下面这条命令。
然后浏览器会直接打开这样一个网页。
我一开始有点懵逼。我以为 dsh 会像 Claude Code 这种 CLI Coding Agent,又或者像 Codex 这种桌面 Agent,没想到它打开的却是 Web UI。好家伙,DeepSeek 又创新了一波。
接下来,去 DeepSeek 官方 API 平台创建一个 API Key。
把 Key 复制到 dsh 的网页里。
填好 API Key,dsh 就可以正常使用了。
对了,使用前记得先往 DeepSeek 账户里充点钱,调用模型消耗的 Token 是需要计费的。
DeepSeek Harness 有什么功能?
第一次打开 DeepSeek Harness,我先看了两个地方。左边是大家很熟悉的对话历史,中间是任务区,可以选工作目录和运行模式。
dsh 必须先选择一个工作文件夹,才能进行对话。先在电脑上建好一个工作目录,再让 dsh 打开它。
接下来就可以正常对话,发起任务了。
对话框右下角可以选择 DeepSeek 模型和推理等级。目前我在页面上看到的默认选项有 DeepSeek V4 Pro 和 DeepSeek V4 Flash。
对话框的左下角也可以对工作目录进行权限控制。
这三种权限,决定了 dsh 到底能不能动你的文件。
• 如果你只是想让它看看代码,选「Read Only」。它默认只能读,不能改。
• 需要它直接帮你修改项目,就选「Workspace Write」,这也是平时最常用的一档。dsh 可以修改当前工作目录里的文件,遇到超出范围的操作,会先问你一声。
• 至于「Full Access」,简单理解就是把护栏拆了。工作目录内外的文件它都能改,也不会再弹出确认。这个权限别随手开,只有你清楚它接下来要做什么时再用。
权限搞清楚后,再来看模式。dsh 这里不只有模型选项,还多了一组运行模式。
这些模式是什么呢?其实不用被名字吓到,四种模式的区别没那么复杂。
• 标准模式 平时用这一档就够了。看文件、改代码、跑命令、查资料、调用 Skills、安排子 Agent,这些常见操作它都能做。如果你只是想让 dsh 完成一个正常的开发任务,直接选它。
• PTC 模式 适合步骤多、流程长的任务。它拥有标准模式的全部能力,区别是会把多次工具操作写成一段 TypeScript 程序,再串起来执行。这样中间数据不用一轮轮塞回模型,最后只把结果送回上下文。碰到工具调用特别多的任务,既能少几次来回沟通,也不容易把上下文越撑越大。比如批量处理文件、连续查询数据,或者跑一整套操作流程,用这个模式会更合适。
• 极简模式 只给模型留下两件基础工具。一个用来执行 Bash 命令,一个用来修改文件,其他能力全部拿掉。它更像是给模型做「裸机测试」,适合观察模型只靠命令行和文件编辑能做到什么。日常使用不用特意选它。
• 创造模式 给想自己定制 Agent 的人准备的。你可以查看 dsh 当前的运行环境、试验不同插件,再把需要的工具和能力组合成一套新的 Agent 模式。简单说,前面三种模式是拿来干活的,这一种是拿来「造模式」的。
如果你要配置插件,可以去设置页面里找。目前官方内置插件已经有 100 多个,后续数量还会继续增加。
执行任务后,dsh 也会把本次任务的 Token 消耗和缓存命中等信息列出来。
还有一个设计我很喜欢,dsh 会展示本次任务的完整轨迹,可以回看它是怎么一步步干活的。这对想学习 Agent 执行过程的同学很有帮助,有点像浏览器开发者工具里的请求追踪。
而且它记录的不只是最后的聊天内容。模型收到了什么提示词、调用了哪些工具、改了什么文件、怎么压缩上下文,这些过程都会留在任务轨迹里。所以哪一步出错了、Token 花在了哪里,基本都能顺着轨迹往回找。
DeepSeek Harness 实测
下面这些都是我用 DeepSeek Harness + deepseek v4 pro 测试过来的效果。
▲ 【dsh + DS V4 Pro(Max):八足蜘蛛运动轨迹】
▲ 【dsh + DS V4 Pro(Max):3d进球瞬间】
▲ 【dsh + DS V4 Pro(Max):鼠标拖动魔方】
▲ 【dsh + DS V4 Pro(Max):跳一跳小游戏】
最后
最后聊聊 DeepSeek Harness 的体验。
如果你是开发者,你肯定会很喜欢Deep SeekHarness的设计,首先是一切皆插件的设计理念,造就了你可以自由定制化dsh。
还有就是任务的执行过程明细都列的很清楚,还想看的更清楚,还可以去「轨迹」里回看任务完整的执行过程,非常适合帮助你理解任务的执行逻辑和工具调用顺序。
但 dsh 的风格天生偏向开发者,这也决定了它可能不适合普通人,比如你想拿它处理办公事务,大概率会用不习惯,那些硬核设置和功能,看不懂也用不来,而且目前也缺少那种一键安装的 Skill 市场。
对了,还有一个更容易踩的坑!!
如果发现 dsh 卡在某个任务上很久,先别傻等。最好打开终端看一眼,确认 dsh web 到底还在不在运行,我实测的时候就踩过这个坑。
你看,我明明已经把 dsh web 进程关掉了,但页面里的「Deep diving」还在继续计时,看起来就像 DeepSeek 还在后台疯狂思考,极具迷惑性。
也就是说,你看到页面上的时间一直增加,不一定代表任务还活着,这个体验就挺割裂的。
不过吐槽归吐槽,我对 DeepSeek Harness 还是挺看好的。
DeepSeek Harness 最有价值的地方,是给社区留下了很大的改造空间,模型、工具、提示词、上下文和 UI 都能通过插件调整,大家可以围绕自己的真实需求,重新组装 Agent 的能力和工作方式。
等社区生态愈发疯狂,我都不敢想后面的 DeepSeek Harness 会有多恐怖。
- 原文作者:知识铺
- 原文链接:https://index.zshipu.com/ai002/post/20260818/2026-%E6%9C%80%E6%96%B0-DeepSeek-Harness-%E4%BD%BF%E7%94%A8%E6%95%99%E7%A8%8B%E9%99%84%E4%BF%9D%E5%A7%86%E7%BA%A7%E5%AE%89%E8%A3%85%E6%AD%A5%E9%AA%A45-%E4%B8%AA%E5%AE%9E%E6%B5%8B%E6%A1%88%E4%BE%8B-%E7%9F%A5%E4%B9%8E/
- 版权声明:本作品采用知识共享署名-非商业性使用-禁止演绎 4.0 国际许可协议进行许可,非商业转载请注明出处(作者,原文链接),商业转载请联系作者获得授权。
- 免责声明:本页面内容均来源于站内编辑发布,部分信息来源互联网,并不意味着本站赞同其观点或者证实其内容的真实性,如涉及版权等问题,请立即联系客服进行更改或删除,保证您的合法权益。转载请注明来源,欢迎对文章中的引用来源进行考证,欢迎指出任何有错误或不够清晰的表达。也可以邮件至 sblig@126.com