DeepSeek 把 Harness 做成了桌面软件。
9 月 29 日发布的 DeepSeek Harness v0.2 预览版,第一次提供开箱即用的 macOS 与 Windows 安装包,官网直接下载;Linux 用户走 npm 上的 @deepseek-ai/dsh。项目在 MIT 许可下开源。
对一个以”命令行 + 配置文件”为主要使用方式的 Agent 工具来说,出桌面版不是多一个壳那么简单——它意味着目标用户从开发者扩到了普通办公用户。
v0.2 到底更新了什么
桌面端安装包。 macOS 和 Windows 都有打包好的应用,Linux 走 npm 包。
对话内审查文件与代码变更。 生成的文件和代码 diff 直接出现在对话里,右侧栏可以预览、检查、审查,确认没问题再让它继续改;文件也能用本地应用打开。
Automation Task 插件。 用来排重复性的活:有运行历史、重复计划,任务指令还能随时改。
插件管理页。 这次更新的核心,下面单独说。
Creator 模式(实验性)。 用一段文字描述你想要什么功能,它替你生成或配置一个插件,自动保存并出现在插件管理器里。
支持非 DeepSeek 模型。 通过 OpenAI 兼容的 endpoint 接入其他模型,不锁死在一家。
能干的活。 官方举的例子是文档、表格、PDF 的处理——整理资料、分析数据、生成图表、做演示文稿;也能改项目、跑代码,属于开发辅助场景。
顺便说一句,它的模型侧底座刚更新过:早前的 DeepSeek V4.1 Flash 把激活参数压到 8B、KV 缓存砍到四分之一,这类”便宜又能干”的模型正是 Harness 这种高调用量工具的前提。
插件管理页:把命令行那一步省掉
以前给 Harness 装插件,得在终端里敲命令。现在在插件管理页输入 npm 包名就能装,同一个页面还能停用、卸载,查看插件的介绍和来源信息。
门槛降下来的意义比看起来大。命令行那一步劝退的不是”不会用终端的人”,而是”不想为一个插件打开终端的人”——它把装插件从开发者动作变成了用户动作。
官方对插件这件事的定位很明确:插件是这个产品设计的中心,”一切皆插件”的理念在项目立项、写第一行代码之前就定了,连产品界面的一部分都是由插件构成的。
一个值得注意的官方数字:按官方模型 API 用户口径统计,约 60% 的 Harness 用户使用了第三方插件。团队说接下来会建设官方插件市场,并让插件 API 更稳定,降低第三方开发者的维护负担。
那个 Claude Code Mods 兼容层是怎么回事
v0.2.1-alpha.1 版本新增了一个 Claude Code Mods 兼容层,官方标注为实验性功能。
它的目的不是”让 Harness 能跑 Claude Code 的插件”,而是反过来验证一件事:Claude Code Mods 的扩展能力,是不是 DeepSeek Harness”一切皆插件”架构的能力子集。
项目组成员崔添翼的说法比较克制:现阶段还不能实现全部 Claude Code Mods 的无缝运行,但从技术层面看,未来具备这个可能性。
为什么这件事值得单独拎出来说?因为上一周刚发生的事是 Anthropic 给 Claude Code 上线了 Mods——用几十行 TypeScript 就能挂到事件层上改提示词、拦危险命令。如果 Mods 写的程序真能跑到另一套 Agent 上,那”插件”就不再是某一家产品的私产,而开始变成一层公共能力。
当然,现在只是 alpha 阶段的方向性验证,离能用还差不少。
官方给的两个百分比,该怎么读
发布说明里有两个数字很容易被当成结论引用:
- “Harness 是官方 API 用户中使用最广的编程 Agent(按日活和日会话数算)”
- “约 60% 的 Harness 用户使用第三方插件”
两条都是官方口径,没有独立验证。更关键的是分母:它限定在”通过官方 API 访问模型”的用户,不含自建部署、走第三方转发或者用其他方式的用户。
所以这两个数字证明的是生态活跃度和插件文化,不能读成绝对用户量。看到”使用最广”这类表述,先问一句:在谁里面最广。
三步上手
第一步,装起来。 从官网下 macOS 或 Windows 安装包,或者 Linux 上 npm i -g @deepseek-ai/dsh,然后配上模型 API key。想省事的话,也可以直接接 OpenAI 兼容的其他模型 endpoint。
第二步,装一个插件试试手感。 打开插件管理页,输入一个 npm 包名装上,再试一遍停用和卸载。这一步的目的是让你知道”插件是可插拔的”,装了不满意可以拿掉,不用重装软件。
第三步,排一个重复任务。 建一个 Automation Task,把每天都得干的那件活排成周期任务——比如”每天早上整理某个目录里的文档,输出一份表格”。设好之后再去对话里让它跑一次,看看运行历史。
想系统选工具的话,可以先看 AI 编程工具专题;如果你更关心”怎么把 Agent 接进工作流”,AI 智能体与自动化专题 里的路线更完整。
优缺点
优点
- 桌面端开箱即用,不用先折腾终端环境
- 插件的装、停、卸全在图形界面里完成,门槛明显降低
- 定时任务是内置插件,不用自己写一套调度
- MIT 开源,还支持接入非 DeepSeek 模型,不绑定供应商
- 对话里直接审查文件与代码 diff,改错了能当场回退
缺点
- 还是预览版,功能随时可能变
- Mods 兼容层是实验性功能,官方自己明确说不能全部跑通
- 插件是第三方代码,官方没公布独立的插件质量与安全审核机制
- 生态数字只有官方口径,”使用最广”这类说法缺第三方验证
- Creator 模式同样标着实验性,生成插件的稳定性未知
适合谁,谁先别急
适合上手的人
- 已经在用 DeepSeek API 的开发者,迁移成本几乎为零
- 需要 Agent 处理文档、表格、PDF 的办公场景,不想碰命令行
- 想低成本试”插件化 Agent 架构”到底长什么样的人
- 手上有一堆重复活、想用定时任务收掉的人
先别急着换的人
- 需要稳定生产环境的团队——预览版不适合当生产依赖
- 已经深度绑定 Claude Code 或 Codex 工作流的人,迁移成本大概率大于收益
- 对插件安全敏感的场景:第三方插件就是第三方代码,这一点先想清楚
四个替代方案
Claude Code。 官方 Mods 已经能改事件层,生态相对成熟,插件和钩子文档齐全;代价是官方原话——Mods 不在沙箱里,装的每段代码都跟你本人同级。
OpenAI Codex CLI。 跟 Codex 云任务打通,适合已经用 OpenAI 采购额度、不想新增供应商的企业。
H Company Holo4。 开源的计算机操作智能体,一个模型横跨桌面、网页、安卓和 MCP 接口;代价是高分版本非商用授权,能商用的那版能力要打折。
腾讯 BrowserSkill。 让 Agent 借用你已经登录的浏览器干活,适合那些”必须点网页”的场景,验证码仍然得你自己点。
老达点评
一、这次更新真正值钱的不是桌面版,是插件管理页。 桌面版改变的是使用姿势,插件管理页改变的是生态结构——它把”装插件”从工程师动作变成用户动作,第三方插件的潜在使用者一下子大了几个量级。
二、Mods 兼容层是聪明的一手棋。 官方把话说得很留余地:”验证是否是能力子集”。翻译过来就是——先声明我们的架构是超集,姿态摆在这儿。至于实现能不能跟上,那是后面的事,但话语权已经先占了。
三、60% 那个数字要打个折看。 分母是官方 API 用户,不含自建和转发。它说明的是”用 Harness 的人里插件文化很浓”,而不是”Harness 有很多用户”。这两个判断差得很远。
四、想上手的话,别一口气装十个插件。 先挑一件你每周都要重复干的活,用 Automation Task 把它收掉——跑通一次,你就知道这东西值不值得留下。插件装多了,排查问题的时间会比省下来的还多。
预览版的样子已经挺完整了。等插件市场和沙箱安全那两块补上,这东西才算真正定型。