Meta新研究:LLM法官在质疑下判决翻转率高达71%
omarsar0 · x · 2026-08-14
Meta的新论文提出Wiggle框架,对9个前沿模型在14个评判任务上进行压力测试,包括重新提示、单一挑战和持续压力。结果发现所有模型都会'摇摆':在静态质疑下判决翻转25-71%,在对抗性说服下翻转62-91%。压力改变判决几乎总是对真实标签有害。基线陪审团多数强度是预测哪些项目会移动的最佳单次预测指标。
所属事件:Meta研究:LLM评判者被说服后判决翻转率高达91%(2 条相关)→
「模型」频道最新
- DeepSeek-V4 Pro 与 Fable 任务相关性最低 — zainhas · 2026-08-15
- DeepSeek-V4 Pro 击败 Sol 与 Fable — zainhas · 2026-08-15
- 27B 参数 Qwen 3.8 全指标碾压传闻中万亿模型 — zainhas · 2026-08-15
- 90%用户不需要SOTA模型,谷歌瞄准大众市场 — haider1 · 2026-08-15
- Veo、H3、Seedance视频生成对比 — Then_Editor_7958 · 2026-08-15
- DeepSeek-V3 超越 GPT-4o 与 Claude 3.5 Sonnet — zainhas · 2026-08-15