DeepSeek Harness 上手指南:一行命令跑起本地编程 Agent

8月13日晚,DeepSeek 双发:V4 Pro 旗舰模型 + DeepSeek Harness v0.1(MIT 协议,开发者预览)。模型抢了头条,但对做 Agent 的人来说,harness 才是更值得看的那个——它就是 DeepSeek 内部评测自家编程 Agent 用的那套运行时,核心思想一句话:一切皆插件

为什么这层值得研究

Agent ≠ 模型。模型是大脑,harness 是让模型能读文件、调工具、管上下文、失败重试、连续干几小时活的那层工程外壳。Claude Code 证明了这层值钱,DeepSeek 的选择是直接把它开源。别再把编程 Agent 当黑盒用了,这次整盒都能拆开看。

快速上手:一行命令

前置条件只有 Node.js 18+。npm 包会在你本机起一个 Web UI:

# 启动 Web UI(默认 http://127.0.0.1:3080)
npx @deepseek-ai/dsh web

浏览器打开后:左侧是工作区列表(每个对应本地一个项目目录),中间是对话区,每一步工具调用都摊在时间线上。想从源码跑也行:

git clone https://github.com/deepseek-ai/deepseek-harness.git
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh web

四种内置模式

  • 标准模式:全套编程 Agent——文件编辑、shell、网页/文件搜索、技能、规划、目标管理、子 Agent、工作流。
  • Code(PTC)模式:工具通过 Code Mode SDK 暴露,模型直接写一段 TypeScript 程序,把本来要来回调十次的工具操作合并成一次执行。
  • 极简模式:只留一个持久 bash 和一个文件编辑器。官方用途是评测——拆掉外壳花活,看模型裸实力。
  • 创造模式:自己造新模式。另外三种本质上也就是三份插件配置清单。

一切皆插件

内核叫 Cordis,出自 Koishi 聊天机器人框架生态的微内核。模型、工具、技能、会话、沙箱、存储、循环、调度,连你看到的 UI 本身都是插件。两个特性让它真正可用:

  • 可逆副作用:插件注册时产生的副作用全部被追踪,卸载时自动回收——热插拔,不用重启,不留垃圾不漏内存。
  • 可被发现:仓库打上 dsh-plugin topic 就能进社区目录(如 awesome-dsh-plugins,发布一天内收录 288 个仓库)。

值得先装的两个:dsh-plan-execute 让规划走推理模型、执行走便宜模型,账单立省;dsh-vision 桥接任意 OpenAI 兼容视觉模型,给纯文本的 DeepSeek 模型装上眼睛。沙箱也是配置项——sandbox-microsandbox-mxcsandbox-nono 三选一。

全程可追溯

Trajectory:模型看到的一切——系统提示词、推理过程、工具调用与结果、子 Agent 调度、上下文注入——全部写进一份只增不改的会话日志。按来源逐条查,还能恢复、分叉、搜索、回放。排障从「猜」变成「回放」。

实践建议

  • 做好变更准备:README 全大写警告 THERE WILL BE COMPATIBILITY-BREAKING CHANGES,做插件记得锁版本。
  • 认真对待沙箱:插件能碰你的 shell 和文件系统,选好隔离方案再放它进生产。
  • 评测用极简模式:去掉 harness 变量,比的是模型不是外壳。
  • 配合 V4 Pro 用:同晚发布的 V4 Pro Agent 基准暴涨、原生支持 OpenAI Responses API,接入细节和 token 预算坑见 DeepSeek V4 Pro API 上手指南

资源链接

滚动至顶部