Prompt 加一句「不许猜」让模型编造字段从 71% 降到 20%
FKJ · hn · 2026-09-28
作者在做数据抽取类基准测试时发现,仅在被污染/误导的 prompt 中加一句「Do not guess」,就能让 LLM 编造不存在字段的比例从 71% 大幅降到 20%。
- 实验设置:给模型包含诱导性假字段的任务,统计其捏造输出字段的比例
- 结论:LLM 对指令中的暗示高度顺从,一行指令即可显著抑制幻觉式编造
- 启示:在生产 prompt 中明确「不知道就别猜」是性价比极高的防幻觉手段
文章附带完整基准与复现细节,见原文。
「研究」频道最新
- HuggingFace 本周高赞论文:世界模型与 Agent 自我改进上榜 — yshan2u · 2026-09-28
- ML 筛选 5000 万化合物,7 种蜂类驱避剂田间实验全部有效 — VraserX · 2026-09-28
- 等宽字体可视化 token:帮你理解模型为何"犯怪" — amplifiedamp · 2026-09-28
- 哪些 benchmark 还没被刷爆?RLI 最高分仅 20% — MaximumIntention · 2026-09-28
- 微软研究:千余个无中心编排 Agent 协作,通过率升至 55% — omarsar0 · 2026-09-28
- 研究称 LLM 可从纯语言分布推断因果结构,反驳章鱼实验论 — AndrewLampinen · 2026-09-28