跳到主内容

DeepSeek 开源首款 Agent 产品 Harness(dsh):一切皆插件,要做 Agent 时代基础设施

DeepSeek 于 2026-08 开源首款 Agent 产品 DeepSeek Harness(dsh),提出 AGENT = MODEL + HARNESS,以「Everything is a plugin」为核心,模型/工具/技能/会话/沙箱/UI 皆由插件组合,MIT 协议,本地 WebUI 一键启动。本文拆解其定位、能力与行业意义。

2026-08-14 · DeepSeek(GitHub)

发布 2026-08-14

要点

  • DeepSeek Harness(dsh) 于 2026-08-13/14 以开发者预览形式开源,软件包已发布至 npm(npx @deepseek-ai/dsh web 启动本地 WebUI,端口 3080)。
  • 核心公式:AGENT = MODEL + HARNESS——模型负责思考推理,Harness 承担工具调用、任务规划、执行调度等全部工程化工作。
  • 设计理念 「Everything is a plugin(一切皆插件)」:模型、工具、技能、会话、沙箱、存储、循环、调度、UI 全部由插件组合,可自由替换重组。
  • 已支持:项目管理、长任务协作、多 Agent 编排、上下文管理、联网搜索、Skill,以及可创建不同「Agent 预设」。
  • MIT 开源;内测用户已做出长期记忆、界面修改等插件。

为什么是「Harness」而不是新模型

DeepSeek 这次放的不是一个新模型,而是一套「驾驭模型的马具工程」。真实任务一旦复杂,纯大模型会「聪明但记不住目标」:要记得最初要什么、知道哪一步调什么工具、中间数不对要回去核验、完成要自检。把这些「目标 / 工具 / 流程 / 纠错 / 验收」封装成系统,就是 Harness。

官方给的公式很直白:Agent = 大模型 + Harness。模型聪明决定每一步走对,Harness 高明决定始终记得要去哪。

与 Codex / Claude Code 的本质差异

Codex、Claude Code 是「装修好的办公室」——菜单、对话、结果都预先设计好;DeepSeek Harness 更像「刚交付的毛坯房」:墙、门、电路都有,但工位怎么摆由你决定。前者是做好的 Agent,后者是组装 Agent 的运行时。

其架构核心是 Cordis 消息传递内核,具备「时空可组合性」。连网页界面本身都是默认加载的一个插件,可在 Creator 模式下用对话直接改页面——已有内测用户让 Harness 自己加出一个「服务器监控面板」入口。

行业意义

DeepSeek 的野心不在做一个爆款产品,而在做包含底座、插件与定制产品的 Agent 生态基础设施。Agent 时代的竞争不只在模型层(拼算力/算法/数据),也在 Harness 层(拼工程能力)。对中国团队而言,这是把「工程师 + 复杂商业场景」的优势转化为 Agent 能力的机会——模型差距不会因一套 Harness 消失,但在工程层做深,有机会更快缩短 Agent 能力差距。

谁该关注

  • 想在国内基础设施上 DIY 专属 Agent 的开发者与企业;
  • 认同「Agent 竞争在工程层」的判断、愿意投入插件生态的探索者;
  • 关注开源 Agent 运行时替代 Codex/Claude Code 的人。

注意:当前为 developer preview,官方明确「迭代很快、会有破坏性变更」,勿用于生产关键链路。

AI 之家 观点

把 Harness 单独开源,是 DeepSeek 今年最容易被低估的一步。多数厂商在「模型 → 产品」这条路上做闭环,Harness 是中间那层谁都能用、但谁都不愿意先开放的工程资产;DeepSeek 把它 MIT 出去,等于把竞争从「谁的模型强」推到「谁的运行时被更多人接」。

但要分清两件事:「开源了运行时」不等于「有了生态」。Everything is a plugin 的代价是默认体验弱——毛坯房对装修队是自由,对只想拎包入住的人是负担。参考 Claude Code 与 Codex 的路径,真正起量的 Agent 产品都是先给「装修好的办公室」,再逐步开放可替换件。

AI 之家 推荐结论:想在国内基础设施上自建 Agent、且有能力投入插件开发的团队,值得现在就开始跟——preview 阶段参与能影响接口形态。只想找能立刻干活的编码 Agent 的人,先别碰:这个阶段它会消耗你大量时间在安装与调试上。

相关阅读

来源

相关对比

Aider vs Claude Code:终端 AI 编程双雄怎么选

Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。

Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比

Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)

Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Devin vs Claude Code:AI 编程 Agent 怎么选?异步自主 vs 终端同步对比

Devin vs Claude Code 2026 选型对比:Cognition 异步自主 Cloud Agent vs Anthropic 终端同步 CLI Agent,从形态、工作模式、长任务能力、并发、价格、中文支持和适合人群 8 个维度判断,帮你选对 AI 编程 Agent。

相关评测