研究发现审计修复上下文会使 LLM 更宽容
Parsa Mazaheri · hf · 2026-08-18
研究指出,在上下文中包含先前的审计和修复环节会降低 LLM 验证器的误报率,机制是改变决策阈值而非提升鉴别能力。此外,修复内容和审计结论对不同模型家族的影响呈现互补性。
「研究」频道最新
- Spellcaster 六 Agent 闭环:解决 AI 生成游戏不可玩难题 — 量子位 · 2026-08-18
- HumanCLAW 开源:9 个前沿 VLM 具身测试全军覆没,最高仅 16.8% — liuziwei7 · 2026-08-18
- 索引不需全精度:聚类压缩省 60 倍 — _reachsumit · 2026-08-18
- RSI Bench 发布:量化 AI 递归自我改进能力 — dhruv2038 · 2026-08-18
- Scale AI 发布 RSI-Bench,公开征集任务:每任务 2000 美元加论文共同作者 — dhruv2038 · 2026-08-18
- Meta 论文 Dear Algo:用意图层统一搜索与推荐 — _reachsumit · 2026-08-18