我感觉特别适合刚开始接触 Agent小白,或者一直在用 Claude Code、Codex、Pi,但是没有真正了解过Harness 是什么的人。
作者把Harness拆分的很简单,主要记住了几个东西。
1、System Prompt,其实就是 Agent 的工作说明
模型本身不知道你想让它怎么工作。
Harness 会先告诉它现在是什么角色、应该怎么做、有哪些边界。
所以同一个模型放在 Claude Code、Pi、Codex 里面,表现完全可以不一样。
模型没换,外面的工作方式已经换了。
2、Tools 决定了模型到底能不能真正干活
单纯 Chat 更多是在回答你。
接上搜索、文件、Terminal、浏览器这些 Tool 以后,模型才开始真正拥有行动能力。
但有工具还不够,Harness 还得负责把这些东西组织起来。
3、Agentic Loop 才是 Agent 真正开始工作的地方
搜不到就继续搜,代码改完跑测试,失败了再回来继续改。
不是回答一次就结束,而是一轮一轮往下跑,直到任务完成。
我现在看 Agent,也越来越在意它一条任务到底会跑多少轮。
4、还有一个很容易被忽略的 Translation Layer
这一点我挺喜欢。
今天底层挂 Claude,明天换 GPT,后面再换 DeepSeek、千问,理论上都不需要把整套工作流重新搭一遍。
Harness 在中间负责把不同模型、API 和 Tool Protocol 接起来。
真正决定你怎么使用它的,是外面的 Harness。
模型是 OpenAI、Anthropic 做的,我控制不了下一版会怎么改。
但 System Prompt、Tool、Skill、Extension、Session,甚至最后挂哪个模型,这些东西我都可以自己决定。
如果你最近也在研究 Agent,我挺推荐看一下 What is a Harness?