一套完整的Agent Harness方法论:
- 模型负责理解、判断和规划;
- Skills负责领域流程;
- Tools连接真实系统;
- UI通过Tool Call表达;
- Harness执行安全边界;
- Evals把产品需求变成可自动验证的测试。
这套方法论的核心,是把Agent拆成两个世界:
- 模型负责处理开放、模糊、需要判断的问题;
- Harness负责处理确定、敏感、必须可靠的问题。
换句话说,模型是“认知与决策层”,Harness是“运行时与控制层”。Skills、Tools、UI和Evals则分别解决知识、执行、交互和质量控制问题。
这里最重要的不是某一个组件,而是职责边界。