让模型更保守竟导致误判率上升?Prompt 工程陷阱
CupGlass540 · reddit · 2026-08-27
作者在生物医学矛盾检测任务上发现了一个反直觉现象:指示模型保持“保守”(倾向于输出 NOTENOUGHINFO)虽然能显著提高拒答率,但却并没有改善判断方向,反而导致模型在条件缺失时更倾向于断言存在矛盾。
关键发现:
- 数据缺陷:标准数据集 ManConCorpus 中 77.1% 的配对至少缺失人口、干预或结果指标,导致基准本身不可比。
- 保守策略失效:在条件缺失时,模型因看不到差异(因为条件没写),反而认为两个对立的主张是“干净”的冲突,从而增加了误报。
- Prompt 脆弱性:仅改变 Prompt 措辞就能改变 45% 的裁决结果,且大模型(14B)与小模型(8B)对“无法判断”和“无矛盾”的界定存在巨大分歧(将“未知”视为“否定”)。
作者建议:如果基于检索文档做冲突检测,需警惕这种“因信息缺失而误判为冲突”的符号翻转问题。
「模型」频道最新
- 观点:预训练是变换,后训练是翻译 — Liu_eroteme · 2026-08-27
- 呼吁社区推广 LoRA 分发以节省下载带宽 — Borkato · 2026-08-27
- GPT-5.6 额度用光后,网友转头测 Opus 5 的数学能力 — DimitrisPapail · 2026-08-27
- Grok Bot 发布 v0.29.0 版本更新 — mark_k · 2026-08-27
- GLM-5.3-Flash 本地部署实测:206 tok/s 与 1M 上下文 — funding__secured · 2026-08-27
- GLM-5.3 Flash 上线 Papers with Code,Luna 因延迟仍是默认 — NielsRogge · 2026-08-27