DeepSeek Harness 是什么?一文读懂这个"一切皆插件"的开源 Agent 框架
一句话定义
DeepSeek Harness(缩写 dsh)是 DeepSeek AI 开源的 Agent 框架(智能体运行时),负责把大模型"接"进真实世界:读写文件、调用工具、执行命令、控制权限、决定重试还是中止、管理持续数小时甚至数天的长周期任务,都是它的工作。2026 年 8 月 13 日,官方以 MIT 协议发布了 v0.1 开发者预览版。
官方给出的分工公式非常简洁:
Model + Harness = Agent
模型负责思考与推理,Harness 负责执行与落地。这个定位让它直接对标 OpenAI Codex、Anthropic Claude Code / Claude Cowork 等产品,主打编程与办公自动化场景。
"一切皆插件"到底是什么意思
这不是一句营销口号,而是架构事实:在 DeepSeek Harness 里没有特权组件。模型、工具、技能、会话、沙箱、存储、Agent 循环、任务调度,甚至 UI,全部都是插件,谁都可以被加载、卸载、替换或重组。
它的底层是 Cordis——一个只负责插件加载、卸载和依赖管理的微内核,Koishi 机器人生态已经用它稳定运行多年。插件之间通过服务(service)和事件(event)协作,能力挂在 ctx.tools、ctx.llm、ctx.agentLoop 这类稳定的上下文键上。想换一个能力,不需要改 Harness 源码,改配置即可。
四种内置模式:一套内核,四种装法
| 模式 | 定位 | 特点 |
|---|---|---|
| 标准模式(Standard) | 日常 Agent 任务 | 加载相对完整的工具集合,开箱即用 |
| 极简模式(Minimal) | 模型基准测试 | 只保留 Shell 与文件编辑工具,尽量减少外围差异,直接观察模型规划与终端操作能力 |
| PTC 模式(程序化工具调用) | 批量 / 顺序型任务 | 模型先生成一段程序,由程序编排多轮工具调用,减少模型与工具之间的反复往返 |
| 创造模式(Creative) | 实验与开发 | Agent 可以在内存中试验 Cordis 插件、组合出全新的运行模式 |
核心能力:为什么它不是普通的"工具调用"封装
1. 全链路可观测、可回放
一个会话(Session)由按顺序追加的事件构成,是 Agent 全部交互历史的唯一事实来源。系统提示词、思维链、工具调用及其结果、子 Agent 调度、上下文注入都会被记录,并可在 Trajectory(轨迹视图)中按来源查看。当 Agent 在第几十步做出错误决定,你可以回到当时模型真正看到的上下文,判断问题来自模型判断、工具返回、提示词还是上下文注入,甚至可以像 git 分支一样恢复、分叉、回放。
2. 上下文与长周期任务管理
框架内置项目管理、长周期任务协作、多智能体编排、上下文管理与联网检索能力,避免开发者从零拼凑工具链。
3. 与 MCP 处于不同层级
MCP 是连接 AI 应用与外部数据、工具和工作流的开放标准,解决"怎么连"的问题;Harness 解决的是更上层的运行逻辑:什么时候把工具交给模型、调用前是否需要审批、结果如何写回会话、失败后是否重试、Agent 何时派出子任务、又在什么条件下停止。因此,MCP 服务器可以成为 Harness 生态中的一个插件来源。
适合谁用
- 爱折腾的开发者:想深入理解 Agent 运行时,或想二次开发自己的智能体产品;
- 模型评测团队:用极简模式做更接近真实工程任务的基准测试;
- 企业内部工程团队:希望保留自有沙箱、存储与权限体系,避免被单一 Agent 产品绑定;
- 插件作者:面向 dsh 生态编写并分发技能、工具与整机插件。
需要注意:v0.1 预览版官方明确提示会有破坏性变更,适合尝鲜与学习;追求稳定生产环境可等待版本收敛。
关键信息速览
| 官方页面 | https://www.deepseek.com/harness/ |
|---|---|
| GitHub | deepseek-ai/deepseek-harness |
| 底层框架 | Cordis("时空可组合性"插件元框架) |
| 快速启动 | npx @deepseek-ai/dsh web → http://127.0.0.1:3080 |
| 社区入口 | GitHub Discussions、Discord、GitHub 上 dsh-plugin 话题标签 |