🎯 核心主张(一句话)
Agent = Model + Harness。模型的智力你改不了,但 Harness(马具)的配置权全在你手里——而 2026 年的行业共识是:马具比马更能决定拉车的成绩。
📖 正文
Harness 是什么:马具隐喻
Harness 原意是马具——挽具加缰绳。马有力气,但没有马具就拉不动车;马具不改变马的力量,它改变的是力量的传导与控制方式。
Claude Code 官方定位就是 Agentic Harness:包裹在 Claude 模型外层的编排框架。原生模型只会生成文本,是一个有智力但没手脚的大脑;给它读文件、写代码、跑命令、管权限、压缩上下文这一整套基础设施的,是 Harness。
用一个公式记住这层关系:Agent = Model + Harness。你在终端里对话的是 Claude(模型),幕后管理上下文、调度工具、控制权限的是 Claude Code(Harness)。你指挥马的意志,传导力量的是马具。
关键行业洞察:Harness 差异 > 模型差异
书中给出 2026 年初的一个行业判断:同一模型在不同 Harness 下的表现差异,远大于不同模型在同一 Harness 下的差异。三个佐证:
- TerminalBench:不换模型,只优化 Harness,同一模型的成绩从基线以下冲进 Top 5。
- Vercel:删掉 80% 的 Agent 工具,流程反而更精简、Token 更省、响应更快——Harness 里的"减法"也是优化。
- OpenAI:3 名工程师、0 行手写代码,产出 100 万行产品级代码——因为他们构建的是 Harness,而不是代码本身。
这个洞察直接打掉"等下一代更强模型"的幻想。模型能力边界由 Anthropic 划定,你无法改变;但 Harness 的每一个配置——CLAUDE.md 怎么写、工具权限怎么设、Hooks 接在哪、MCP 连什么——全部在开发者手中。 学 Claude Code 的每一项能力,本质上都是在调教 Harness。
冰山之下:8 大机制各治一种病
多数人只用到冰山露出水面的一角:开终端、说需求、拿代码、关窗口。水面之下才是 Harness 的主体。

8 大机制,每个都对应一个具体痛点:
| 机制 | 治什么病 |
|---|---|
| 记忆系统(CLAUDE.md) | 模型无状态、每次对话都"失忆",项目规范写一次、每次自动加载 |
| Skills | 风格飘忽、口头叮嘱不管用,把领域知识和规范做成可自动加载的技能 |
| 子智能体 | 长任务上下文溢出,把大任务拆进隔离的上下文单元,只回传结论 |
| Hooks | 概率性模型不可靠,在工具调用等关键节点插入确定性的拦截与检查 |
| MCP | 数据孤岛,用标准协议接入外部数据库、API、工单系统 |
| Headless 模式 | 只能人守着终端,让 Claude 无人值守地跑在 CI/CD 流水线里 |
| Agent SDK | 只能用现成产品,用 Python/TS 代码直接驱动核心能力,从使用者变构建者 |
| Plugins | 好配置难复用,把以上所有能力打包成可分发的标准格式 |
"Claude 不够聪明"是个误诊
书里小冰的三个抱怨很典型:每次新会话都要重讲技术栈;代码风格时好时坏,PR 被打回 3 次;6 个文件的重构做到第 4 个就忘了前面的逻辑。看起来是三个 bug,其实是同一个病根:把一个 Agent 框架当成了高级聊天窗口。
三个问题在框架层各有现成解法:技术栈固化进 CLAUDE.md,审查标准封装成 Skill,大重构拆给子智能体。反复口头复述、人工拆任务、肉眼查风格,本质是低效的"手动写脚本";框架化用法是把这些变成一次性的系统配置。当你觉得"Claude 不够聪明"时,大概率只是你只用了 Harness 10% 的能力。 配置一旦确立,它不遗忘、不懈怠、不因深夜加班而降低标准——这是把个人经验固化为制度的工程思想。
🧭 业界视角(书外补充)
- Anthropic 40 万会话研究(2025.10–2026.04):典型会话里,人做大部分规划决策,Claude 做大部分执行决策;使用者领域专业度越高,单条指令撬动的工作量越大。这佐证了本篇主题——价值增量来自人对"缰绳"的设计,不是模型本身。(来源:anthropic.com/research/claude-code-expertise)
- Vercel 团队:删掉 80% 的 Agent 工具后流程更快更省。工具不是越多越好,是越少越准——Harness 工程一半是加法,一半是狠心的减法。
- Karpathy 等人的 agentic engineering 框架:研究 → 计划 → 执行 → 审查 → 交付,人是监督者不是打字员。先用 Plan mode 把探索和执行分开,避免"把错误的问题解决得很漂亮"——这是 Harness 思维在工作流层面的延伸。
- Boris Cherny(Claude Code 创造者):他自己的 CLAUDE.md 只有约 100 行,经验法则是 200 行以内——前沿模型可靠遵循的指令总量约 150-200 条。调教 Harness 不等于堆配置,超载的缰绳等于没有缰绳。
🔗 知识网络
- upstream:index
- downstream:Claude Code 四层架构与 Agentic Loop
- 平行关联:CLAUDE.md 记忆系统工程 · Hooks:给概率模型上确定性缰绳