Reverse-Harness:按风险治理的运行时自取工具,基准从 6% 提到 61%

Rameswaranmohan1993 · reddit · 2026-09-09

作者用四个月做的开源(MIT)项目 Reverse-Harness,思路与传统 agent 框架相反:不预先塞固定工具集,而是让运行中的 agent 在缺能力时主动请求补齐,由“Governor”按风险仲裁。

核心机制

两个非显然的设计

实测

179 次试验、5 个模型/5 家厂商、任务设计为不补能力就不可能完成、外部 oracle 评分:冻结工具集 6%,受治理的按需拉取 61%(McNemar p = 2.8e-10)。作者坦承小模型写工具质量差、安装偏重、评测是自己做的欢迎被打破。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →