可见证据
看清每项发现由哪些项目或会话信号支撑。
Better Harness · 开源 Agent Work Loop 洞察
Better Harness 在你已经使用的 Coding Agent 中运行,把项目与会话证据转化为工作循环洞察、改进优先级和可验证的下一步。
把证据、影响、范围明确的修复方案和验收检查放进一份可评审的报告。目前支持十个宿主适配器。其中六个已有验证过的配置路径;Pi、Kimi Code、WorkBuddy 与 Grok 会进入各自当前的支持边界说明。
添加仓库 marketplace,然后安装插件。
查看配置步骤选择 Desktop 或 CLI,获取对应的准确入口。
查看配置步骤内置于 Qoder Desktop;Qoder CLI 可复用桌面版,也可单独安装。
查看配置步骤使用 --plugin-dir 加载源码本地插件。
查看配置步骤作为 Qwen Code 扩展安装。
查看配置步骤添加 Marketplace 并安装插件。
查看配置步骤安装与证据适配器已可用;完整交互式报告闭环仍待冒烟验证。
查看支持详情插件、证据与报告适配器已可用;完整交互式报告闭环仍待冒烟验证。
查看支持详情证据与报告适配器已可用;安装仍通过 WorkBuddy 自有路径完成。
查看支持详情证据与报告适配器已可用;安装方式是把 Skill 软链到 ~/.grok/skills。
查看支持详情Better Harness 不会把没有依据的判断写进评分,而是把观察到的工作流缺口整理成团队可以检查、讨论和验证的发现。
看清每项发现由哪些项目或会话信号支撑。
先处理对工作流影响最大的缺口。
让建议改动始终限定在已观察到的问题范围内。
明确需要哪些证据,才能让改进进入评审。

这张静态最终帧汇总了历史 Harness 报告,展示的是已记录的趋势,而非改进的因果证明。
Better Harness 将前馈引导(AGENTS.md、规格、Skills、验收标准)与反馈传感器(Lint、测试、Hooks、评估智能体)结合起来,评估交付的五个环节——即 Agent Work Loop(智能体工作循环):
智能体是否清楚目标,以及“完成”意味着什么?
工作是否运行在受支持、可重复的路径上?
是否有证据表明改动真的有效?
AI 的速度是否绕过了质量检查或验收?
下一个任务能否从这一个任务中受益?
十个能力层宿主适配器进入同一条证据流水线。其中六个已有验证过的快速开始路径;Pi、Kimi Code、WorkBuddy 与 Grok 的当前适配器支持边界会明确展示。