Skip to main content
功能说明

Better Harness

检查 Agent 工作所依赖的工程环境,并把问题整理为可执行的改进方案。

Better Harness 检查的不只是某一次任务回答,而是 Agent 完成任务所依赖的整套工程环境。它可以帮助你找到反复影响任务理解、执行、验证或交付的薄弱环节,并把值得复用的经验沉淀为可维护的项目资产。

什么是 Agent Harness

Agent 通常会循环完成“理解任务—执行操作—检查结果—继续调整”。要让这个循环稳定运行,除了模型能力,还需要清晰的项目上下文、可用的工具、明确的操作边界、可靠的验证方法,以及从以往任务中保留经验的机制。 这些支撑 Agent 工作的机制共同构成 Agent Harness。根据项目情况,它可以包含仓库说明、Rules、Skills、Hooks、Plugins、Connectors、脚本、测试命令、发布检查和人工审核环节。它的作用是帮助 Agent 回答四个实际问题:
  • 预期结果是什么,哪些内容不在本次范围内?
  • 应该如何运行和修改这个项目?
  • 哪些证据可以证明结果正确?
  • 操作或验证失败后应该如何处理?

为什么使用 Better Harness

Harness 的缺口往往不会在一次成功任务中暴露,而会在长期使用中反复出现:同一条要求需要不断重申、项目约定没有文档、验证步骤容易遗漏,或评审反馈没有进入下一次任务。Better Harness 用于梳理这些重复模式,并找到能够避免问题再次发生的最小长期改进。

检查范围

  • 任务目标、范围和项目上下文。
  • Rules、Skills、Hooks、Plugins、Connectors 等可复用 Agent 资产。
  • 执行入口、控制方式和反复依赖人工完成的步骤。
  • 验证证据、交付步骤和任务结果。
  • 应沉淀为长期规则、流程或工具的项目反馈。
检查的目的不是为了增加更多配置,而是找到具体缺口和最小、可维护的改进方式。例如,缺失的项目约定适合写入 Rule,可重复执行的流程适合沉淀为 Skill,必须稳定执行的检查则更适合通过 Hook 或脚本实现。

从检查到改进

Better Harness 通过以下闭环帮助你推进改进:
  1. 梳理当前 Harness:识别任务上下文、执行路径、可复用资产、验证步骤、交付流程和已有反馈。
  2. 找到断点:定位流程中缺少明确说明、实际接入、执行证据或失败恢复方式的位置。
  3. 选择最小长期修复方式:根据问题选择合适的 Rule、Skill、Hook、脚本、工作流或人工审核环节。
  4. 验证改进结果:在可审查的独立任务中实施修改,运行相关检查,并通过后续代表性任务确认新机制已被实际使用。

发起检查

  1. 在需要检查的工作区打开一个任务。
  2. 在任务输入框中输入 /better-harness
  3. 在斜杠命令建议中选择 better-harness:better-harness
  4. 补充希望重点检查的问题,例如发布任务反复遗漏验证、测试证据不足,或 Agent 经常忽略项目约定。
  5. 发送任务,让检查基于当前项目和相关任务记录进行分析。
从具体症状开始,比笼统要求“优化所有配置”更容易得到可执行结果。

审视并实施改进

逐条确认问题依据、受影响的流程、建议的长期修复方式和后续验证方法。选择一条验收标准清晰的问题,使用独立任务实施修复并执行项目检查;随后再次运行 Better Harness 或代表性任务,确认新机制确实生效。 不要把临时故障或一次性偏好写成永久项目规则。长期资产应解决重复出现的问题,并能被后续维护者理解。