研究发现审计修复上下文会使 LLM 更宽容

Parsa Mazaheri · hf · 2026-08-18

研究指出,在上下文中包含先前的审计和修复环节会降低 LLM 验证器的误报率,机制是改变决策阈值而非提升鉴别能力。此外,修复内容和审计结论对不同模型家族的影响呈现互补性。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →