检查 Agent 工作所依赖的工程环境,并把问题整理为可执行的改进方案。
Better Harness 检查的不只是某一次任务回答,而是 Agent 完成任务所依赖的整套工程环境。它可以帮助你找到反复影响任务理解、执行、验证或交付的薄弱环节,并把值得复用的经验沉淀为可维护的项目资产。
Agent 通常会循环完成“理解任务—执行操作—检查结果—继续调整”。要让这个循环稳定运行,除了模型能力,还需要清晰的项目上下文、可用的工具、明确的操作边界、可靠的验证方法,以及从以往任务中保留经验的机制。
这些支撑 Agent 工作的机制共同构成 Agent Harness。根据项目情况,它可以包含仓库说明、Rules、Skills、Hooks、Plugins、Connectors、脚本、测试命令、发布检查和人工审核环节。它的作用是帮助 Agent 回答四个实际问题:
Harness 的缺口往往不会在一次成功任务中暴露,而会在长期使用中反复出现:同一条要求需要不断重申、项目约定没有文档、验证步骤容易遗漏,或评审反馈没有进入下一次任务。Better Harness 用于梳理这些重复模式,并找到能够避免问题再次发生的最小长期改进。
Better Harness 通过以下闭环帮助你推进改进:
逐条确认问题依据、受影响的流程、建议的长期修复方式和后续验证方法。选择一条验收标准清晰的问题,使用独立任务实施修复并执行项目检查;随后再次运行 Better Harness 或代表性任务,确认新机制确实生效。
不要把临时故障或一次性偏好写成永久项目规则。长期资产应解决重复出现的问题,并能被后续维护者理解。
什么是 Agent Harness
Agent 通常会循环完成“理解任务—执行操作—检查结果—继续调整”。要让这个循环稳定运行,除了模型能力,还需要清晰的项目上下文、可用的工具、明确的操作边界、可靠的验证方法,以及从以往任务中保留经验的机制。
这些支撑 Agent 工作的机制共同构成 Agent Harness。根据项目情况,它可以包含仓库说明、Rules、Skills、Hooks、Plugins、Connectors、脚本、测试命令、发布检查和人工审核环节。它的作用是帮助 Agent 回答四个实际问题:
- 预期结果是什么,哪些内容不在本次范围内?
- 应该如何运行和修改这个项目?
- 哪些证据可以证明结果正确?
- 操作或验证失败后应该如何处理?
为什么使用 Better Harness
Harness 的缺口往往不会在一次成功任务中暴露,而会在长期使用中反复出现:同一条要求需要不断重申、项目约定没有文档、验证步骤容易遗漏,或评审反馈没有进入下一次任务。Better Harness 用于梳理这些重复模式,并找到能够避免问题再次发生的最小长期改进。
检查范围
- 任务目标、范围和项目上下文。
- Rules、Skills、Hooks、Plugins、Connectors 等可复用 Agent 资产。
- 执行入口、控制方式和反复依赖人工完成的步骤。
- 验证证据、交付步骤和任务结果。
- 应沉淀为长期规则、流程或工具的项目反馈。
从检查到改进
Better Harness 通过以下闭环帮助你推进改进:
- 梳理当前 Harness:识别任务上下文、执行路径、可复用资产、验证步骤、交付流程和已有反馈。
- 找到断点:定位流程中缺少明确说明、实际接入、执行证据或失败恢复方式的位置。
- 选择最小长期修复方式:根据问题选择合适的 Rule、Skill、Hook、脚本、工作流或人工审核环节。
- 验证改进结果:在可审查的独立任务中实施修改,运行相关检查,并通过后续代表性任务确认新机制已被实际使用。
发起检查
- 在需要检查的工作区打开一个任务。
- 在任务输入框中输入
/better-harness。 - 在斜杠命令建议中选择 better-harness:better-harness。
- 补充希望重点检查的问题,例如发布任务反复遗漏验证、测试证据不足,或 Agent 经常忽略项目约定。
- 发送任务,让检查基于当前项目和相关任务记录进行分析。