DeepSeek Harness 实测:与 Codex、WorkBuddy 的差异化对比
2026 年 8 月 12 日,DeepSeek 不仅发布了 V4 Pro 0831 新版本模型,更同步推出了全新的本地 Agent 运行框架——DeepSeek Harness(简称 dsh)。
DeepSeek Harness 目前处于开发者预览阶段,包名为 dsh。作为一款开源工具,其定位类似于 Claude Code、Codex 及 WorkBuddy,但核心理念有所不同。
如下图所示:
图:DeepSeek × HARNESS 联合标识
该工具虽聚焦于开发者群体,但并非单纯的编码辅助软件。本质上,它是一个“模型容器”:用户可自由接入不同大模型、加载插件并编排工作流,dsh 则提供一套完整的本地 Agent 基础设施。
01
一、即装即用,零门槛启动
dsh 通过 npm 发布(包名@deepseek-ai/dsh),其本质是一个本地 Agent 运行框架而非单一模型产品。安装 Node.js 后,仅需一条命令即可启动。终端将输出本地访问地址(http://127.0.0.1:3080),浏览器打开即可看到“探索未至之境 / 预览版”界面。
如下图所示:
图 1:终端运行 dsh web,输出本地访问地址
启动后会弹出内测声明:当前为 0.1 版本,面向 Harness 开发者测试,核心插件与基础 API 正在持续迭代中,旨在邀请开发者共建 DSH 插件生态。
如下图所示:
图 2:内测声明弹窗
相比 Codex 需要安装桌面客户端、绑定 OpenAI 账号及经过繁琐的权限审批,dsh 作为 npm 包,实现了本地运行、浏览器访问且无额外账号壁垒,流程更为简便。
官方确立了“一切皆插件”的设计理念。0.1 预览版的核心任务并非功能完备,而是搭建插件生态框架。在设置导航中,已预留通用设置、模型管理、插件中心、Agent 预设四大入口,架构清晰,内容待填充。
02
二、四种模式覆盖多元场景
Web UI 提供了模式下拉菜单,包含标准模式、PTC 模式、极简模式和创造模式四种选项。
如下图所示:
图 3:模式下拉菜单
用户反馈指出:“四种模式中,创造模式尤为突出,体验类似 Pi。”
标准模式:提供完整工具组合,涵盖文件编辑、Shell、检索、Skills、计划目标、子代理及工作流等,满足日常开发需求。
PTC 模式(Programmatic Tool Calling):面向具备开发背景的用户。该模式不依赖模型逐步手动调用工具,而是生成 TypeScript 代码,将多轮工具调用打包统一执行,属于 Code Mode SDK 层面的高级应用。
极简模式:仅保留 Shell 和文件编辑两个核心工具。该模式专为测试模型本身行为设计,通过减少干扰确保结果可复现。DeepSeek 对外发布的性能指标均基于此模式运行。
如下图所示:
图:V4 Pro Agent 基准对比表
创造模式:最具创新性的模式。支持创建自定义 Agent preset、运行时检查及插件实验,并提供创作指导。其定位并非单纯执行任务,而是协助用户探索思路、设计 Agent 的工作方式,具有强烈的协作与启发属性。
从极简到标准,再到 PTC 和创造,四种模式精准对应四类用户:测试工程师、普通日常用户、专业开发者及 Agent 设计者。dsh 通过模式拆分而非功能堆砌,实现了对不同用户群体的全面覆盖。
03
三、开放架构,非 DeepSeek 专用
这是 dsh 与传统认知中"DeepSeek 专属工具”的最大区别。
在设置的模型页面中,提供方列表涵盖了 anthropic、openai、google、groq、cerebras、deepseek、azure-openai-responses、amazon-bedrock 等主流厂商。DeepSeek 仅为默认选项之一,用户可自由配置其他模型。
如下图所示:
图 4:模型提供方列表
用户评价:“支持超多模型,意味着它并非 DeepSeek 专用。”
dsh 不绑定特定模型,这一设计决定了其“框架而非产品”的定位:外壳由 DeepSeek 构建,内核可由用户自由选择。
以下是三款工具的生态位对比:
| Codex | WorkBuddy | dsh | |
|---|---|---|---|
| 形态 | CLI + 桌面 agent | 平台内置能力 | 本地 Web 框架 |
| 模型绑定 | OpenAI | 平台默认 | 多提供方可选 |
| 扩展方式 | OpenAI 生态 | 平台(钉钉)生态 | 插件生态(开放) |
| 运行位置 | 本地/云端 | 平台内 | 本地 |
Codex 深度绑定 OpenAI 编码能力,WorkBuddy 依托职场平台生态,而 dsh 的核心价值在于提供一个“兼容多模型的通用框架”。三者生态位截然不同,dsh 的出发点在于解耦模型与工具,而非单纯的功能竞争。
04
四、试用建议与边界说明
值得尝试,但需明确 0.1 版本的局限性。
推荐理由:安装便捷(一条命令)、浏览器即用、无需额外账号、创造模式极具潜力。用户可在 5 分钟内完成部署,利用现有 API Key 体验四种模式。特别是对于有 Agent 构建需求的用户,创造模式提供了比从零搭建更高效的入口。
注意事项:官方明确提示“核心插件与基础 API 持续迭代”。作为面向开发者的预览版,接口可能变动,插件稳定性尚待验证,不建议作为主力生产工具使用。
此外,dsh 的多模型支持赋予了用户极大的灵活性:可用 Groq 上的开源模型进行测试,用 DeepSeek 处理日常任务,或用 Claude 应对复杂推理。这种框架层与模型层的解耦设计,在同类工具中并不多见。
05
五、战略转型:从价格战到生态战
此前,DeepSeek 的策略侧重于模型定价竞争(如 V4 Flash 的低价策略)。此次推出 dsh,标志着其战略路径的转变:不再仅仅发布更便宜的模型,而是通过提供本地运行框架,吸引开发者共建插件、Agent preset 及工具链生态。
生态竞争与价格战的逻辑迥异。价格战往往是零和博弈,而生态建设具有叠加效应。尽管目前 dsh 插件生态尚处起步阶段,但其多模型支持、四种模式划分及“一切皆插件”的架构,显示出长远的战略规划。
对于工具使用者而言,拥有一个不绑定模型的本地框架具有重要意义:无需等待单一厂商生态成熟,即可自主选择模型、定制插件、定义 Agent 运行逻辑。
建议用户花费 5 分钟安装体验,重点关注创造模式。DeepSeek 此次提供的不仅是一个工具,更是一个开放的、不绑定模型的智能体壳层。
总结:装来玩 5 分钟,重点看创造模式——DeepSeek 这次给的不是又一个工具,是一个不绑模型的壳。

