DeepSeek 又放王炸!开源 Harness:一切皆插件,AI 智能体的"乐高底座"来了

2026 年 8 月 13 日,DeepSeek 悄悄开源了一个项目,上线不到一天 GitHub Star 突破 8 万,目前已超 11 万。

它不是新模型,而是一个让模型"真正能干活"的运行框架——DeepSeek Harness,简称 dsh


在这里插入图片描述

一、先搞懂:什么是 Harness?

DeepSeek 官网挂着一个非常直白的公式:

AGENT = MODEL + HARNESS

翻译成人话:

  • **模型(Model)**是大脑,负责思考和决策;
  • **Harness(运行框架)**是身体,让大脑能读文件、跑命令、调工具、持续工作。

过去一年,Claude Code、Codex CLI 爆火,大家逐渐意识到一个真相:

拉开 Agent 体验差距的,往往不是模型本身,而是外面这层 Harness。

同样一个模型,套在不同的 Harness 里,干活效率天差地别。

DeepSeek 这次的操作很直接——把自己的 Harness 整个开源掉,而且做得非常彻底:一切皆插件(Everything is a Plugin)


二、"一切皆插件"到底是什么意思?

传统 Agent 框架(比如早期的 LangChain 应用)是"焊死"的:模型接入方式、工具列表、会话存储都写死在代码里,想换个模型、加个工具,得改源码、重新部署。

而在 DeepSeek Harness 里,所有能力统统是插件

能力 在 dsh 中的形态
模型接入(DeepSeek / OpenAI / 自定义端点) 插件,可替换
工具(Shell、文件编辑、检索) 插件,可增删
技能(Skills) 插件
会话管理 插件
沙箱(安全隔离) 插件
存储 插件
任务循环与调度 插件
Web UI 界面 也是插件

内核 Cordis 只干一件事:管理插件的加载、卸载和依赖关系,本身不承载任何 Agent 具体能力。

打个比方:Cordis 是电脑主板的插槽,具体用什么 CPU、显卡、内存,全看你插什么卡。

连 DeepSeek 自己的模型都没有特殊地位,它也就是又一个插件而已。想换成 Kimi、GLM、任何 OpenAI 兼容端点的模型,跟换个主题皮肤是同一个操作。


三、四种运行模式,按需选择

dsh 预设了四种模式,本质上是四份不同的插件配置清单:

模式 定位 适合谁
标准模式 功能完整的编码 Agent 日常开发使用
PTC 模式 模型写 TypeScript 脚本编排多轮工具调用 复杂长任务
极简模式 仅保留 bash + 文件编辑器 模型基准测试
创造模式 热加载插件、造新模式 框架开发者

重点说一下 PTC(Programmatic Tool Calling)

普通模式下,模型每调一次工具就要跟客户端来回一次,十次工具就是十轮往返。PTC 换了个思路——让模型直接产出一段 TS 脚本,把操作串起来一次跑完。

相当于模型从"逐条下指令的实习生",变成"自己写脚本批量跑的工程师"。

好处是快、省 token;坏处是脚本跑起来你得看清楚它在干什么——所以沙箱和权限策略要配好。


四、5 分钟快速上手

前置要求

  • Node.js v22.19 以上(用 node --version 确认,低版本会报错)
  • 一个 DeepSeek API Key(去 DeepSeek 开放平台申请)
  • 一个想让 Agent 操作的项目目录

第一步:一条命令启动

npx @deepseek-ai/dsh web

建议先 cd 到你的项目目录再启动,dsh 会把当前目录作为默认工作区。

启动后浏览器打开 http://127.0.0.1:3080,就是 Web UI。

第二步:配置 API Key

进入 Settings → Models,找到 DeepSeek 卡片,填入你的 sk-... 保存即可。

Key 存在本地配置目录,界面只显示脱敏后的描述符,不会回显明文。

第三步:选择工作区,派活

点「选择工作区」,添加并选中你的项目目录(不选工作区输入框是灰的)。

然后直接发任务,比如:

总结这个仓库,告诉我主要的包结构

Agent 会自主读文件、跑命令、维护执行计划。涉及写操作时,UI 会按权限策略弹审批,不会偷偷改你东西。


五、Trajectory:给 Agent 装个"黑匣子"

dsh 有一个很打动人的设计——Trajectory(轨迹)机制

模型看到的一切,都会写入"仅追加"(append-only)的会话日志,包括:

  • 系统提示词
  • 思维链(CoT)
  • 每一次工具调用与返回结果
  • 子 Agent 调度过程
  • 每一次上下文注入

在 Web UI 的 Trajectory 视图里可以按来源逐条查看。出了问题能完整复盘,跑得好的会话还能 fork 出来继续用。

恢复、分叉、检索、回放共享同一份事件流——相当于给 Agent 装了"黑匣子 + 时光机"。


六、插件生态:社区已经疯了

官方明确欢迎第三方插件,约定了 dsh-plugin GitHub topic。开源当晚就有 288 个插件仓库,目前已超 1000 个。

挑几个有意思的:

  • dsh-vision-toolkit:给纯文本模型加一双眼睛,支持图片问答、长截图 OCR、UI 还原
  • dsh-TUI:Claude Code 风格的全屏终端界面
  • dsh-web-ui:Web UI 增强全家桶,任务看板、Git 图谱、实时 token 统计
  • dsh-feishu-bot / dsh-weixin-bot:装上就能变成飞书、微信群里被 @ 的机器人

最绝的是有个叫 dsh-ads 的插件,给 Web 界面加上 2005 年风格的弹窗广告——而旁边紧挨着一个专门屏蔽它的插件。广告是插件,去广告也是插件,生态自己先完成了一轮攻防。

装插件也很 DSH:把仓库地址丢给对话框里的 Agent,说一句"帮我装这个",它自己读完 README 就把活干了。


七、和 Claude Code / Codex 有什么不同?

维度 Claude Code / Codex DeepSeek Harness
开源 闭源 MIT 全量开源
架构 功能焊死 一切皆插件
模型绑定 绑定自家模型 模型即插件,可自由替换
可定制性 有限 模型/工具/UI 全可换
轨迹可追溯 有限 append-only 完整日志
定位 产品 框架 + 参考实现

简单说:Claude Code 是"一辆装好的车",你只能开;dsh 是"一套底盘 + 零件库",你可以自己组装成任何形态。


八、注意事项

  1. 开发者预览阶段:官方明说会有破坏性变更,生产环境慎用,跟进版本要看 changelog。
  2. Node 版本要够新:必须 v22.19+ 或 v24+,别拿 v18/v20 硬怼。
  3. 安全攻击面比一般工具大:插件能碰你的 shell 和文件系统,第三方插件装之前看一眼源码。
  4. 密钥安全:Key 只写进本地配置,别提交进 git;工作区交给 Agent 前最好先 git init,方便回滚。
  5. Windows 用户:优先用 Web UI 方式,Python SDK 建议走 WSL。

九、写在最后

DeepSeek 选在 API 调价的同一个晚上开源 Harness,不是巧合。

Anthropic 需要 Harness 这层值钱,因为它卖的是"模型 + 外壳"的整体;DeepSeek 需要 Harness 不值钱,因为这层一旦被拉平成公共品,竞争就被压回模型本身的能力和价格上——而那已经是 DeepSeek 的主场。

R1 当年把闭源模型的溢价打下来,这一次 DSH 想把闭源外壳的溢价也打下来。

现在,你可以零成本把 DeepSeek Harness 跑在自己机器上,随便改成自己想要的样子——模型、工具、UI,没有一样是焊死的。

仓库地址:https://github.com/deepseek-ai/deepseek-harness
官网:https://deepseek.com/harness/


你觉得"一切皆插件"的 Agent 框架会成为下一代标准吗?欢迎在评论区聊聊你的看法。

如果这篇文章帮到了你,点赞 + 在看 + 转发,就是对我最大的支持。

Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐