新基准 Harness-IF 揭示:AI 编程助手并非真正听懂你的规则

omarsar0 · x · 2026-08-14

当前编码 Agent(如遵循 AGENTS.md)虽然会遵守用户设定的规则,但很多时候它本来就会那么做。为了区分“真正服从指令”和“巧合行为”,研究人员提出了 Harness-IF。

评估方法:

通过从执行证据中逐一为 256 条规则打分,然后在九个探针构建中保留和剔除规则重新运行任务,从而找出真正违背模型默认行为的规则。

关键发现:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →