DeepSeek采用插件式开放架构来构建 Agent Harness:模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等所有 Agent 能力均由插件组合而成,可自由替换、灵活重组
Harness 正在成为独立的一层
大模型决定能力的上限,Harness 决定这些能力如何被组织和使用。
模型之外,Agent 还需要工具、技能、会话、沙箱、存储、循环、调度和 UI。过去这些模块往往被写进一个整体系统,牵一发而动全身。
DeepSeek Harness 的选择,是把这些能力全部做成插件。开发者不必修改 Harness 源码,就可以选择、替换或扩展任一模块。
我认为,这比增加几个新工具更值得关注。它试图解决的不是某项具体能力,而是 Agent 系统如何长期演进。
元框架只管理组合关系
DeepSeek Harness 建立在 Cordis 插件系统之上。Cordis 本身只负责插件的加载、卸载和依赖关系,具体的 Agent 能力都由插件提供。
插件通过服务和事件协作,再由配置决定如何组合。这样一来,模型、工具和运行环境不再被固定在同一套实现里。
这种架构的价值,在于把变化隔离开。模型可以更换,工具可以增减,沙箱和存储也可以独立演进,而不必反复重写整个系统。
但插件化并不会自动带来简单。接口是否稳定、依赖是否清晰、插件之间如何避免冲突,才是它能否真正形成生态的关键。v0.1 仍是开发者预览版,核心插件和基础接口还会快速变化,现在更适合观察方向,而不是把它当成已经定型的平台。
四种模式对应四类问题
DeepSeek Harness 预设了四种运行模式,本质上是用不同的插件组合服务不同场景。
标准模式提供完整的工具集合,面向一般任务。
PTC 模式让模型生成代码,以程序化方式组合多轮工具调用。它关注的是复杂工具链如何减少模型逐步交互的成本。
极简模式只保留 shell 和文件编辑工具,用来在尽量少的系统干预下进行模型基准测试。
创造模式则更进一步:它可以检查当前运行时,在内存中试验 Cordis 插件,并据此组合新的运行模式。
我看重的不是模式数量,而是这些模式共享同一套底层结构。开发、测试、实验和创造不再需要维护几套彼此割裂的 Harness。
可追溯是 Agent 的基础能力
DeepSeek Harness 把模型看到的内容写入仅追加的会话日志,包括系统提示词、思维链、工具调用及结果、子 Agent 调度和上下文注入。
恢复、分叉、检索与回放都建立在同一份事件流之上,开发者还可以在 Trajectory 视图中按来源查看信息。
Agent 的问题往往不是没有完成任务,而是完成过程难以解释和复现。尤其当工具调用、上下文注入和子 Agent 调度交织在一起时,只保存最终答案远远不够。
统一事件流把运行记录从调试附属品变成了系统底座。只有先把过程留下来,后续的评估、定位、复盘和恢复才有可靠依据。
开源只是起点
DeepSeek Harness v0.1 已面向全球开发者开放测试,并以 MIT 协议开源。团队希望开发者共同建设插件生态。
这条路线最终能否成立,不只取决于核心代码,也取决于插件接口能否经受快速迭代,第三方插件能否稳定协作,以及不同组合是否仍然保持可观察、可复现。
从更长的周期看,Agent 竞争不会只发生在模型层。谁能把模型、工具、环境和运行过程组织成可替换、可组合的基础设施,谁就更有可能承接持续变化的能力生态。
DeepSeek Harness 现在给出的,是一个尚未完成、但方向明确的答案:Harness 不应是一套封闭程序,而应成为一个可以不断重组的运行系统。