沙箱 agent 复核代码评测只对 60%,把判断题拆成可验证题后 12/12 全对

Grimmoner · reddit · 2026-10-08

作者分享了给 agent 配真实 shell 又不信任它的沙箱方案,以及一次失败的「用 agent 复核代码评测」实验和修复过程。

沙箱设计

复核实验(对照人工答案集,约 70 个评分项)

修复方法

心得:观察 agent 错误的偏向(作者的偏向是 fail open);把问题缩到答案可验证的程度,再用代码而非另一个模型去核对;给真 shell 没问题,前提是环境足够无聊。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →