老高AI观察 · 第19期|2026 年 10 月 3 日
国庆假期第三天,AI 圈最硬的消息不是哪个模型又刷新了榜单,而是一个开源项目把”要不要装 Node.js”这道门槛拿走了。
9 月 29 日,DeepSeek Harness 发布 v0.2 预览版,同时上线 macOS 与 Windows 两个桌面安装包——从命令行工具,变成双击就能装的软件。
这条消息没炸出多少水花,但分量不在”又多了一个 AI 工具”。榜单每周都在换名字,这次动的是下面那一层——把 Node.js 和终端一起拿掉了。

两个安装包,拆掉了终端门槛
8 月 13 日,Harness 以开发者预览版 v0.1 开源,MIT 协议,TypeScript 写成,要靠 npx @deepseek-ai/dsh web 这类命令启动。据 中国证券网 9 月 29 日的报道,开源半小时内 GitHub 星标破万,8 月 27 日已超 20 万。
9 月 29 日的 v0.2 预览版把这步删掉了:官方给出 macOS 与 64 位 Windows 安装包,登录账号或填一个 API Key、选定本地工作区,就能像用普通桌面软件一样派活。

这一版还补了:新增插件管理页,输入包名就能装卸;内置可开启的自动化任务插件,能把重复工作设成定时任务;”创造模式”里用一句话描述需求,它能自己写一个插件出来。
据官方按模型 API 用户口径的统计,约 60% 的用户已经在跑第三方插件。
这周,桌面智能体挤成一排
先看时机。第一层是补课。8 月 13 日开源到 9 月 29 日上桌面只隔 47 天,项目立项更早——据 Pandaily 的梳理,Harness 今年 5 月在内部立项,从一开始就对标 Claude Code。
第二层在外部。同一周,Earendil 的 Pi 1.0 发布,AWS 也开源了给智能体用的沙箱。
两件事叠起来是个判断:命令行正在变成上一代界面。谁能让人每天打开它,谁才拿到入口——而”每天打开”这件事,靠敲命令做不到。
上一期我写《DeepSeek 开源昇腾工具链》,讲的是它在软件和芯片之间补了一层;这次补的是软件和用户之间那一层。同一个方向,往前挪了一步。
贵的不是模型,是模型外面那层
官方文档一句话说透:agent 等于 model 加 harness。读仓库、改文件、跑命令、记住发生过什么,这些都不是模型干的。过去两年大家比前半句,这次比后半句。
账上最能说明问题。据 这篇英文评测,同一个模型分别放进两套运行时:Harness 每完成一个任务平均花 0.028 美元,Claude Code 约 0.195 美元;每任务消耗 88,562 个 token,对 649,900 个。30 道基准题,Harness 过 20 道,Claude Code 过 19 道。

写代码是少数能按任务算钱的场景。”这个任务跑一次花多少”能直接进预算表。差距进入七倍量级后,能不能把 agent 放进日常流程就不再是态度问题。
成本优势来自两处:默认接口更省 token,二是能接自家低价的 DeepSeek V4.1 Flash。换别的后端差距会收窄——账本会变,算法不变。想做对照测试,站内收录的 JellyToken 这类聚合调用平台就能跑。
它抢的不是榜单,是入口
第二个看点是路线。Harness 用 MIT 协议,不绑定自家模型,任何 OpenAI 兼容端点、Ollama、LM Studio 都能接。它不想让你为它换模型,而是想成为”默认被调用的那一层”。
底层是 Cordis 插件框架,官方叫”一切皆插件”:模型适配器、沙箱、会话日志、调度器,连界面都是可替换的插件。Claude Code 大约开放 30 个生命周期钩子,Harness 允许你把核心换掉——一个像成品,一个像平台。
还有个细节容易被忽略:接口可以换到自定义端点或本地模型。用官方 API,会话日志进 DeepSeek 服务器;换了端点,数据不出你的机器。这是目前少数能完全离线跑的编程智能体。
站内收录的 DeepSeek Harness 就是这一版的产品页;想对照国产编程模型,可以再看 GLM-5.3。整条线收在 老高AI观察 里。
哪些人的活儿会先变
普通用户可以先不动。受益的仍是写代码和搭流程的人,日常用哪个助手不会因为这版更新就换。先变的是另外两拨人。
做 AI 工具生意的人要重排优先级。以前评估编程助手看模型能力和月费,现在多一栏——接进来要改多少东西。Harness 是 MIT,能整个叉出去嵌进自家产品,”做个壳子卖订阅”的生意会被压缩。
写代码的人短期不用急着换,但值得加一栏”够不够便宜到能随手跑批”。想同时对照商业侧的成熟形态,可参考 Claude Code(Anthropic 的官方命令行编程智能体,社区积累更好)。
多一个选项,不等于必须换。但供应链上多一条腿,谈条件时底气不一样。
便宜是算出来的,不是测出来的
这段说点不利的。第一,那几个漂亮数字都来自第三方评测,不是官方发布口径,跑法也没公开到能复现——这些数字都是推算出来的,不是厂商测出来的。
第二,它现在是开发者预览版。官方文档写得直白:会有破坏兼容性的变更,安全审计尚未完成,并警告”错误、恶意输入或不可信插件可能损坏文件或泄露数据”。跑生产关键流程,现在不是好主意。
第三,生态差距实打实。Harness 记录在案的插件约 80 个,多数来自官方;Claude Code 背后是两年社区积累,单任务也更快(约 263 秒对 283 秒)。
还有一条更基础的:它不是”更安全的 agent”,只是”更可控的 agent”。权限怎么划、日志留多久仍要自己定。这道题我在《常驻智能体的权限怎么划》里写过一次。
现在就能试的两件事
只想看看它长什么样:下载桌面版,接一个便宜的模型端点,给它一个不重要的文件夹,让它整理一批文件并生成一份表。半个下午能有直观感受,风险也低。
在做产品的人,先量一件事:把手头最松耦合的小模块搬进去,记下改了多少行、省了多少钱。要不要迁移看这张表,不看评测文章。
做内容或评测的人,值得提前加一栏维度:能不能本地跑。接下来半年,这条比”能不能用”更能拉开差距。
想再往深看一层,可参考 DeepSeek DSec(DeepSeek 公开的大规模智能体训练沙箱平台)。
一句实在话
真正在变贵的不是模型,是模型外面那一层——而那一层,现在有两种活法。
编程智能体延伸问答
它能替代 Claude Code 吗?
现在不能。它是开发者预览版,插件生态与生产稳定性都还不如 Claude Code,更适合成本敏感或需要自己改核心的场景。
普通用户现在能用上吗?
能。下载安装包,登录账号或填一个 API Key,选好本地文件夹就能开工,但要自己准备可用的模型接口。
它会不会把我的代码传走?
用官方 API 时会话日志进 DeepSeek 服务器;改用自定义端点或本地模型,数据可以不出你的机器。
这几份材料
- 中国证券网(上证报,2026-09-29):v0.2 预览版与桌面安装包、约 60% API 用户使用第三方插件
- DeepSeek Harness 官方产品页与 GitHub 仓库:MIT 协议、Cordis 插件架构与安全审计未完成的警告
- byteiota(2026-10-02):第三方评测的每任务花费与 token 消耗、30 题通过数
- Pandaily(2026-09-29):插件管理页、自动化任务插件与创造模式
老高,AI工具箱站长,持续记录AI行业的真实变化。想及时拿到AI行业动态、工具玩法和能落地的创业机会——👉 AI工具箱交流群(免费进)
浙公网安备33010202004812号