DeepSeek Harness:把"智能体"拆成乐高
TL;DR
DeepSeek Harness 不是又一个会干活的聊天工具,而是一套把智能体彻底模块化、插件化的开源骨架。
DeepSeek Harness 不是又一个会干活的聊天工具,而是一套把智能体彻底模块化、插件化的开源骨架。

你大概率听过"AI 智能体"这个词了。说白了,就是不光陪你聊天、还能自己上手干活的 AI:写代码、查资料、跑命令、改文件。
可是让 AI 真的动手,背后得有一整套零件撑着。怎么把你的话翻成它能懂的提示词?它能调哪些工具?每走一步谁记录、谁批准、谁兜底?它到底跑在网页里、终端里,还是后台任务里?
这套把 AI 和运行环境粘在一起的底层系统,行内叫 harness(本意是"挽具")。你可以把它想成智能体的操作系统。DeepSeek 最近开源了这么一个 harness,命令行里叫 dsh。
所以dsh到底是什么,它和市面上那些 agent 平台到底有什么区别?
定位
dsh 的招牌口号只有五个字:一切皆插件(Everything is a Plugin)。
智能体 = 一盒乐高
多数智能体工具长这样:厂商把模型、工具、界面、安全策略焊死在一个成品里。你想加点自己的东西?要么塞进它留的小缝里改配置,要么复制整个项目自己改。
而 dsh 底层用了一个叫 Cordis 的插件框架,把产品的每一块都做成插件。模型适配器是插件,工具注册表是插件,会话日志是插件,连驱动 AI 思考的主循环本身也是插件。
这里没有"钦定的核心零件"。官方写的那堆东西,和你自己写的插件,地位平等。要加功能,不去改核心代码,而是在旁边再插一块乐高。插上就生效,拔掉就自动还原,不留下烂摊子。
让它不一样的几处设计
搭积木是声明式的。 dsh 用两层概念组织插件:Bundle 是一组打包好的功能块,Profile 把若干束按顺序叠起来,再贴上你自己的补丁。想象点一份套餐,再告诉店员"这个不要、那个加倍、额外加一份",整个过程写在一份配置里,你从没碰过厨房的菜谱。想看自己机器上拼出了什么?一条命令 dsh --profile web --dump-config 把整棵积木树打印出来。
它有一本黑匣子日记。 这是 dsh 最硬核也最实用的设计。它立了条规矩:任何送进模型里的话,都必须能从我这本日记里重建出来。这本日记就是会话日志,AI 的每一步、每句话、每次调工具,都按顺序记下来。于是跑崩了能回放复现,想换条路走就分叉一条新会话,想审计"它到底看到了什么"日记就是证据。对开发者和企业,这等于给 AI 装了可解释、可追溯的黑匣子。
换零件不拆整机。 dsh 把一个能力拆成三角色:接口(怎么用)、实现(怎么干)、使用者(谁在调)。妙处在"文件系统"和"执行命令"共用同一个底层世界。你只要把执行环境整体指向一个远程沙箱,Bash、终端、代码补全(LSP)会一起被搬走,上层代码一行都不用改。就像把电脑的硬盘加运行环境整体换成云端的,桌面上软件照常工作。
一个大脑,四种面孔。 同一套能力,dsh 能同时长在多种前端上:
| 形态 | 你看到的样子 |
|---|---|
| Web UI | 浏览器里聊天(官方主推的入门方式) |
| 终端 TUI | 全屏命令行界面 |
| Headless | 后台一键跑单个任务,没有界面 |
| ACP / SDK | 作为自动化服务器或程序库,被别的软件调用 |
写一次能力,网页、命令行、自动化脚本全都能用。
它能改自己。 dsh 有个叫 self-modification 的模块,让 agent 能检视并挂载自己的插件。仓库里甚至附了演示:让 AI 在运行时改自己的运行环境。多数工具是出厂定型的,dsh 允许它边跑边给自己装新功能,算一种温和的元编程。
自带安全围栏。 dsh 写了一个原生部件 landlock-run:在 Linux 上,让被启动的程序先自我收紧文件权限,再执行。加上"文件系统、命令、终端共用一个执行世界"的设计,安全策略能统一施加。相当于给 AI 请的临时工发一张只能进指定房间的门禁卡,而不是整栋楼的万能钥匙。
开源,还多语言。 dsh 用 MIT 协议完全开源;核心用 TypeScript 写,同时提供 Python SDK,让 Python 程序像调普通库一样驱动它。社区还能用 dsh-plugin 标签发插件,互相发现。
和别的 agent 平台有什么区别
下面这张表把 dsh 和行业里常见的几类方案对照一下。这里强调设计取向的不同,不是谁好谁坏,很多平台在各自场景里都很强。
| 维度 | 常见做法 | dsh 的做法 |
|---|---|---|
| 扩展方式 | 核心焊死,定制靠配置或小钩子;大改要 fork | 一切皆插件,加功能=插新块,无特权核心 |
| 换模型/换工具 | 常需改代码或受限于内置列表 | 注册一个插件即可,主循环不受影响 |
| 可复现/可审计 | 日志分散,难完整回放 | 会话日志为单一事实源,所见皆可重建 |
| 运行界面 | 多绑定单一形态(CLI、IDE 或 Web) | 同一能力支持 Web、终端、后台、被调用 |
| 安全边界 | 依赖宿主环境,策略零散 | 原生沙箱加统一执行世界,最小权限 |
| 开放性 | 很多闭源或只开放部分 | MIT 全开源,含多语言 SDK 与插件生态 |
| 改自身能力 | 通常不支持 | 支持运行时自挂载插件 |
别的很多平台像买一台成品手机,好用但能改的有限;dsh 像给你一盒手机零件加说明书,出厂就强调"你可以自己拼、自己换、自己加",而且拼出来的每台都留着完整装配记录。
谁会喜欢它,谁先别急
适合这三类人:想深度定制 AI 行为的团队;做 agent 评测的研究者(会话日志天生适合回放打分);希望同一套能力在网页、命令行、自动化里复用的人。
暂时不适合只想装好就能用、不想碰配置的小白用户。dsh 现在还是开发者预览版,需要 Node 环境,而且明确会说有破坏性更新。
最后
DeepSeek Harness 不是又一个会干活的聊天工具,而是一套把智能体彻底模块化、插件化的开源骨架。用"一切皆插件"取代焊死的核心,用"黑匣子日记"换来了可复现和可审计,用"统一执行世界加原生沙箱"兼顾了灵活和安全。
对普通用户,它现在还偏毛坯房;对开发者和研究者,它给的是一种更干净、更可控、也更可拼装的智能体建造方式。
DeepSeek Harness 官方仓库:



