技术热点透视20261005:DeepSeek Harness 上线 Claude Code Mods 兼容层
本文完全由 WorkBuddy 独立收集资料、调试代码并完成文章写作。
我是 Alex Xiang,前百度/微博工程师,现在专注于 AI 工程与工具产品。更多文章欢迎关注微信公众号「字与码」。
国庆假期里,DeepSeek 没怎么休息。10月3日,它给开源 Agent 框架 DeepSeek Harness(简称 dsh)推了一个 v0.2.1-alpha.1,最扎眼的一处改动是:加了一层实验性的 Claude Code Mods 兼容层。第二天,90后负责人崔添翼发文回应。表面上看,这是一次“验证兼容性”的技术实验;往深里看,这是一次关于“Agent 框架这条赛道,到底由谁来定义”的较量。
一个叫 Cordis 的架构,和一句“一切皆插件”
2026 年 8 月,DeepSeek 开源了 Agent 框架 DeepSeek Harness,简称 dsh,MIT 协议。MIT 这个细节不能略过,它决定了别人能改什么、能不能商用,也决定了插件作者愿不愿意把作品押上来。它的架构叫 Cordis,背后有一篇论文《A Programming Paradigm for Spatiotemporal Composability》。名字不重要,重要的是它把什么交给了插件。
在 dsh 里,模型适配器是插件,工具注册表是插件,agent loop 本身也是插件。任意一层都可以被替换。它不锁定自家模型,支持第三方 provider,也支持自定义的 OpenAI 兼容端点。这不是“我们做了个 agent,顺便留了几个扩展点”,而是反过来:先把“一切皆插件”当成第一性约束,再在这个前提下把 agent 拼出来。
到 9 月底、10 月初的 v0.2 公开预览,dsh 已经有官方桌面应用(macOS Apple silicon 与 Windows x64)、插件管理页、文件与 diff 审阅侧栏,能基于文档、表格、PDF 生成图表或幻灯片,还有 Automation Task 定时任务插件。安装包内置 dsh CLI,免装 Node.js 和 pnpm——这一条对国内开发者尤其友好,省掉了环境配置这个最劝退的环节。
它同时还是 DeepSeek 自家的评测台。在 minimal mode 下,DeepSeek-V4-Flash-0731 在 Terminal Bench 2.1 上拿到 82.7。四种会话模式也值得记一下:Standard;Creator,在对话里描述插件,agent 自己写好并安装;PTC,程序化工具调用,Node 代码跑在独立进程里;Minimal,专为评测而生。
兼容层做的事,比“跑通 demo”多得多
10 月 3 日,dsh 发布 v0.2.1-alpha.1,新增实验性的 Claude Code Mods 兼容层。做法是把 Claude Code Mod 的注册函数包装好,挂载成 dsh 插件:钩子可以守卫工具调用、改写 prompt、添加命令与工具、读取会话数据,还能在输入框上方画一条状态带。
随版本附了三个可运行示例:Token Weather、Blast Radius、Replay Theater。名字起得很直观,都是在演示一枚钩子能伸多深。
但边界写得更清楚。官方明确说,目的只是验证 Mods API 的能力是否大致是 dsh“一切皆插件”能力的子集,不是承诺完整兼容。Anthropic 官方仓库里的 4 个 mod——diff、agents-md、sec-default、telemetry——被直接标记为不可运行。mod 走 dsh 自己的配置加载,没有沙箱。
这里补一句背景:Mods 是 Anthropic 10 月初给 Claude Code 推出的定制机制,形态是 JS/TS 事件处理器,可以观察、改写、接管工具调用、prompt 提交与界面绘制。
同版本还加了“Let Agent create a plugin”入口、可选的 Developer Tools 工具包、命令行参数 —public-url,并移除了 runtime invariant plugins——这是破坏性变更。
崔添翼那句话,值得逐句读
10 月 4 日,DeepSeek Harness 负责人崔添翼(90 后)回应了这件事。他说,做兼容层主要是为了验证 Claude Code Mods 给插件作者提供的扩展能力,是否大致是 dsh“一切皆插件”架构能力的子集;目前没办法让所有 Mods 无缝运行,但如果值得投入,技术上未来可能做到。
这句话本身很克制,但对照另一句就很有分量。他说,“一切皆插件”从立项之初、写第一行代码之前就确立了,正如“开源”是 DeepSeek 成立之初的初心——“开源是我们的初心,不是被迫开源的”。
再往下,是他对产品路线的判断:“如果我们抄一个 Claude Code,或者抄一个 Codex,做一个从技术理念到用户体验上都差不多的产品,那一定不是推进 AGI 的事情。”他的目标是做出让世界 AI 巨头认可并跟进的创新。他还提到,自己每天相当一部分时间在为 DeepSeek 招人面试——一个负责人把招聘当成主要工作之一,这本身就是对“做偏门但正确的事”的注脚。
技术验证、生态叙事、开发者心智
把这一连串动作叠在一起看,至少有三层意图。
第一层是技术验证,这是台面上说的那层。拿一个现成生态里真实的 Mod 去压自己的插件模型,比自说自话地宣称“我能扩展”要有说服力得多。Mods 的能力边界就摆在那里,行不行跑一遍就知道,这是最便宜的架构体检。
第二层是生态叙事。dsh 不锁自家模型、不锁 provider、不锁工具,现在连别家 Agent 的扩展格式都试着接。这条信号是发给插件作者的:你的东西在 dsh 上的存活面,可能比在任何一个封闭 harness 里都宽。一个插件作者最怕的事,是写了半年发现平台换了接口;兼容层至少在姿态上回答了这个问题。
第三层是开发者心智,也最微妙。谁先定义“插件”这个词该有多大,谁就能在后面收编别人。先做出兼容,再让 Mods 作者发现 dsh 能装的东西更多、能动的地方更深——先定义、再收编,这是开放叙事的标准打法。它未必是有意为之,但机制上是成立的。
钩子是房子里的智能家居,插件是承重墙
两种范式值得掰开看。
Mods 提供的是钩子:事件处理器,能观察、改写、接管。它的作用对象是一套已经盖好的系统——工具调用、prompt 提交、界面绘制。你能在关键位置插手,但改不了房子本身的结构。用崔添翼的“子集”说法,钩子集合包含于插件能力集合。
dsh 的思路是承重墙都能换。模型适配器、工具注册表、agent loop 都是插件,也就是说连“什么算一个 agent loop”这件事,都可以被重写。
打个比方:给盖好的房子装智能家居,是 Mods;允许你把承重墙拆了改建,是 dsh。前者见效快、风险小,后者上限更高,也更容易翻车。这两条路没有优劣,只有各自的代价。

还有一点常被忽略:钩子模型的抽象层级更高,写起来更省事;插件模型的自由度更大,代价是作者要自己承担更多一致性责任。dsh 把 agent loop 也交了出去,等于把最大的那块责任也交了出去。这个取舍决定了谁会来写插件、愿意写多深。
别被“能跑几个 demo”带节奏
说几点冷思考。
版本号是 v0.2.1-alpha.1,官方自己标了实验性、预览。三个示例能跑,不等于生态能用;Anthropic 官方那 4 个 mod 明确不可运行,就是最直接的反例。把“兼容层上线”读成“Mods 生态可在 dsh 上原样复用”,是过度解读。
然后是安全。Mods 走 dsh 自己的配置加载,没有沙箱,装一个 mod 约等于给它可执行权限。这一周不止一家在提醒这件事:Unity 10 月初同时给 Claude Code、Codex、Grok Build 发布同一套 30 多个官方 skill,单仓库维护、三端同步更新,他们的说法是“我们无法决定你用哪个 coding agent”;Pi 1.0(MIT、最小内核 harness)10 月 1 日发布,同样强调 MCP 与扩展本质上就是“可执行权限”,stable 不等于安全边界。两家互不相干的团队在同一周说同一句话,这比任何一家的措辞都更有信息量。
至于 82.7 这个数字,务必看清前提:minimal mode、Terminal Bench 2.1。它是自家评测台上的一个横截面,不是通用能力的判决书。
开放不等于成熟,这两件事之间隔着很长一段工程。
对国内开发者意味着什么
第一,这是在架构层面主动定义赛道,而不是在别人的框架里写业务。dsh 把“一切皆插件”当成第一性约束,这个选择本身就构成了技术立场:不押模型、不押 provider、不押单一扩展格式。
第二,可移植性被抬高了。插件是统一的抽象层,模型、工具、agent loop 都可换,意味着为 dsh 写的东西不会绑死在某一个模型或某一家云上。对做工具、做内部平台的团队来说,这比多几个内置功能重要。
更现实的一层是学习价值。读懂一个把 agent loop 都做成插件的框架,比记住某个 CLI 的几条命令更耐用:前者是结构认知,后者是操作记忆,前者不会因为版本更新而作废。至于要不要现在就上生产,那是另一回事。
第三,阵营在成形。JetBrains 从 10 月 1 日起在 2026.3 EAP 里向全系主流 IDE 开放 Air,把编辑器改成多智能体调度台(并行智能体跑在独立 Git worktree 上、走 ACP 协议,Junie Lite 免费);加上 Pi 1.0 的 MIT 最小内核、Unity 三端同步的官方 skill,一组偏向开放的 harness 生态正在成形,和封闭的 coding agent 路线形成对照。
需要提醒的是,兼容层目前是预览,可移植性还停留在架构可能性上,而不是已经兑现的承诺。真正决定这条路线成败的,是半年后还有多少插件作者愿意为它写代码。
其他动态
- Microsoft ThinkingBox:10 月 3 日上架 Hugging Face,用“数据库终态”而不是“说了什么”来评估 agent 可靠性——507 个有状态工作流、每任务重复 20 次,约 65.6% 的尝试未通过可执行检查,而多数 agent 是“干净退出”的。
- Tesla Optimus:10 月初周产数百台,但手部灵巧度仍是未解难题;同期 Toyota 宣布将以可对标 Optimus 的规模部署机器人。
- Cursor 云智能体:新增 Projects、自托管运行器与两类新机器人,竞争重心继续从“会写代码”挪向“会编排、会验收”。
微信公众号
欢迎关注「字与码」
如果这篇文章对你有用,也欢迎在微信里继续关注后续更新。
X / Twitter
关注 @ax2_zicode
更即时的技术观察、新文章提醒和一些短想法会发在 X 上。