8月13日晚,DeepSeek 双发:V4 Pro 旗舰模型 + DeepSeek Harness v0.1(MIT 协议,开发者预览)。模型抢了头条,但对做 Agent 的人来说,harness 才是更值得看的那个——它就是 DeepSeek 内部评测自家编程 Agent 用的那套运行时,核心思想一句话:一切皆插件。
为什么这层值得研究
Agent ≠ 模型。模型是大脑,harness 是让模型能读文件、调工具、管上下文、失败重试、连续干几小时活的那层工程外壳。Claude Code 证明了这层值钱,DeepSeek 的选择是直接把它开源。别再把编程 Agent 当黑盒用了,这次整盒都能拆开看。
快速上手:一行命令
前置条件只有 Node.js 18+。npm 包会在你本机起一个 Web UI:
# 启动 Web UI(默认 http://127.0.0.1:3080)
npx @deepseek-ai/dsh web
浏览器打开后:左侧是工作区列表(每个对应本地一个项目目录),中间是对话区,每一步工具调用都摊在时间线上。想从源码跑也行:
git clone https://github.com/deepseek-ai/deepseek-harness.git
cd deepseek-harness
pnpm install
pnpm run build
pnpm dsh web
四种内置模式
- 标准模式:全套编程 Agent——文件编辑、shell、网页/文件搜索、技能、规划、目标管理、子 Agent、工作流。
- Code(PTC)模式:工具通过 Code Mode SDK 暴露,模型直接写一段 TypeScript 程序,把本来要来回调十次的工具操作合并成一次执行。
- 极简模式:只留一个持久 bash 和一个文件编辑器。官方用途是评测——拆掉外壳花活,看模型裸实力。
- 创造模式:自己造新模式。另外三种本质上也就是三份插件配置清单。
一切皆插件
内核叫 Cordis,出自 Koishi 聊天机器人框架生态的微内核。模型、工具、技能、会话、沙箱、存储、循环、调度,连你看到的 UI 本身都是插件。两个特性让它真正可用:
- 可逆副作用:插件注册时产生的副作用全部被追踪,卸载时自动回收——热插拔,不用重启,不留垃圾不漏内存。
- 可被发现:仓库打上
dsh-plugintopic 就能进社区目录(如awesome-dsh-plugins,发布一天内收录 288 个仓库)。
值得先装的两个:dsh-plan-execute 让规划走推理模型、执行走便宜模型,账单立省;dsh-vision 桥接任意 OpenAI 兼容视觉模型,给纯文本的 DeepSeek 模型装上眼睛。沙箱也是配置项——sandbox-micro、sandbox-mxc、sandbox-nono 三选一。
全程可追溯
Trajectory:模型看到的一切——系统提示词、推理过程、工具调用与结果、子 Agent 调度、上下文注入——全部写进一份只增不改的会话日志。按来源逐条查,还能恢复、分叉、搜索、回放。排障从「猜」变成「回放」。
实践建议
- 做好变更准备:README 全大写警告 THERE WILL BE COMPATIBILITY-BREAKING CHANGES,做插件记得锁版本。
- 认真对待沙箱:插件能碰你的 shell 和文件系统,选好隔离方案再放它进生产。
- 评测用极简模式:去掉 harness 变量,比的是模型不是外壳。
- 配合 V4 Pro 用:同晚发布的 V4 Pro Agent 基准暴涨、原生支持 OpenAI Responses API,接入细节和 token 预算坑见 DeepSeek V4 Pro API 上手指南。
资源链接
- GitHub:deepseek-ai/deepseek-harness(MIT)
- 官网:deepseek.com/harness
- 插件生态:dsh-plugin topic
- 模型价格与参数:DeepSeek 工具页
