跳到主要内容

Better Harness · 开源 Agent Work Loop 洞察

把编码交给 Agent,用证据改进它背后的工作流。

Better Harness 在你已经使用的 Coding Agent 中运行,把项目与会话证据转化为工作循环洞察、改进优先级和可验证的下一步。

  • 开源 · MIT
  • 按宿主提供准确步骤
  • 未观察到的证据会明确标注
示例发现 · 证据边界明确Better Harness 示例 HTML 报告,展示一条有证据边界的发现及其影响、预期产出、限定范围的 AI 修复和验收检查把证据、影响、范围明确的修复方案和验收检查放进一份可评审的报告。

选择你的 Coding Agent

目前支持十个宿主适配器。其中六个已有验证过的配置路径;Pi、Kimi Code、WorkBuddy 与 Grok 会进入各自当前的支持边界说明。

从意图到提交,追踪交付全过程

Harness Inspector 在一个只读工作区中,把产品意图与智能体活动、会话、文件和提交串联起来,同时保持证据强度与局限清晰可见。

Harness Inspector 会话视图:提示词、工具调用与提交的同步时间线,配套证据抽屉解释每条关联

该交互式示例使用虚构的英文数据,不会读取你的工作区、Git 历史或 Coding Agent 会话。

打开交互式示例 阅读架构说明

把证据变成下一项具体改进

Better Harness 不会把没有依据的判断写进评分,而是把观察到的工作流缺口整理成团队可以检查、讨论和验证的发现。

可见证据

看清每项发现由哪些项目或会话信号支撑。

影响优先级

先处理对工作流影响最大的缺口。

修复边界

让建议改动始终限定在已观察到的问题范围内。

验收检查

明确需要哪些证据,才能让改进进入评审。

查看自包含的英文示例报告

追踪已记录的长期变化

Better Harness 报告历史的静态最终帧,展示五个 Agent Work Loop 维度随时间的变化

这张静态最终帧汇总了历史 Harness 报告,展示的是已记录的趋势,而非改进的因果证明。

Better Harness 如何工作

Better Harness 将前馈引导(AGENTS.md、规格、Skills、验收标准)与反馈传感器(Lint、测试、Hooks、评估智能体)结合起来,评估交付的五个环节——即 Agent Work Loop(智能体工作循环)

任务理解

智能体是否清楚目标,以及“完成”意味着什么?

可控执行

工作是否运行在受支持、可重复的路径上?

改动验证

是否有证据表明改动真的有效?

可靠交付

AI 的速度是否绕过了质量检查或验收?

经验沉淀

下一个任务能否从这一个任务中受益?

Better Harness 架构:六个公开快速开始宿主以及 Pi、Kimi Code、WorkBuddy 与 Grok 适配器支持进入三个独立证据智能体,再进行统一分析、宿主中立输出和修复

十个能力层宿主适配器进入同一条证据流水线。其中六个已有验证过的快速开始路径;Pi、Kimi Code、WorkBuddy 与 Grok 的当前适配器支持边界会明确展示。