「重复提问直到无新信息」:挖掘 agent 审计盲区的土办法

julianharris · x · 2026-09-12

作者认为当前 AI harness 的可靠性不足以做彻底审计,这一痛点两年内没有改变;架构重构本身是常规操作,真正难的是穷尽式排查。他分享的诀窍是对模型「重复下达同一指令,直到挖不出新信息」——如此反复竟能持续暴露出大量此前遗漏的问题,效果令人惊讶。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →