前沿 Harness 拆解
这个栏目把课程讲义里讲到的 harness 理论,拿当前最前沿的真实产品逐个对照。每个产品我们只关心一件事:它的 harness 是怎么设计的——也就是围绕模型的那层工程基础设施:指令、工具、环境、状态、反馈这五个子系统,以及上下文连续性、初始化、验证、可观测、交接、循环这些核心机制。
我们刻意不谈模型的推理能力强不强、不谈某次跑分高不高,也不泛泛介绍"这个 agent 能做什么"。那些是模型层和产品层的问题。这里只拆 harness——模型权重之外的一切。
为什么值得拆
讲义第一讲说过:模型能力强,不等于执行可靠。同一套模型,放在不同的 harness 里,表现可以差一个数量级。但讲义讲的是"应该怎么做",这些产品回答的是"头部团队实际怎么做"。
每个产品都是一个独立的设计决策集合。把它们放在一起对照,你会看到同样的核心机制,被不同团队用完全不同的方式落地:
- Pi 把 harness 做成极简内核 + 可编程扩展,靠"最小系统提示 + 按需加载"做上下文工程。
- Claude Code 把 harness 做成一个完整的运行环境:分层记忆、五级压缩、权限、钩子、子智能体。
- Codex 把 harness 的哲学推到极致:仓库即事实来源,AGENTS.md 只是目录页,用 worktree 隔离环境。
- DeepSeek Harness 干脆把 harness 本身定义成一种独立于模型的运行时:Everything is a Plugin。
文章列表
- 拆解 Pi 的 harness 设计:极简内核 + 可编程扩展,把上下文工程做进系统提示之外。
- 拆解 Claude Code 的 harness 设计:分层记忆、五级压缩、权限与钩子,一个完整的 agent 运行环境。
- 拆解 Codex 的 harness 设计:仓库即事实来源,AGENTS.md 是目录页,环境隔离与反馈循环。
- 拆解 DeepSeek Harness 的设计:Everything is a Plugin,把 agent 循环本身做成可替换的插件。
怎么读
建议先读讲义的前几讲(尤其是 第二讲:Harness 到底是什么)建立五子系统框架,再回到这里看真实产品如何落地这些机制。
每篇文章的末尾都有"映射到课程框架"和"值得借鉴的设计"两节,帮你把产品设计快速翻译回课程概念,方便直接抄进自己的项目。