杜克大学图书馆发文解析:2026 年了,LLM 为什么还在幻觉
ArtificialOther · x · 2026-10-10
杜克大学图书馆的 Hannah Rozear 撰文探讨为何最新「推理模型」依然会一本正经地编造事实。文章引用 2025 年对杜克学生的调查:
- 94% 的学生认为生成式 AI 的准确性因学科差异很大
- 90% 希望更清楚地了解 AI 工具的局限性
- 但 80% 仍预期 AI 在五年内能个性化自己的学习
文章给出的核心原因之一:LLM 的基准测试奖励「猜测」而非「承认不知道」——模型在评测中靠蒙题拿高分,导致训练与评测导向都不鼓励说「我不知道」(引 OpenAI 的《Why Language Models Hallucinate》一文)。学生在用 AI 拆解复杂概念、总结文献、整理笔记的同时,也在亲身遭遇似是而非的错误输出,有用与不可靠的张力是幻觉长期存在的现实背景。
「漫话AGI」频道最新
- 已故学者 Dan Stein 遗作:AI 与大数据描绘精神医学乐观未来 — PTenigma · 2026-10-10
- Ethan Mollick:AI 让产出翻百倍,但更多 PowerPoint 不等于进步 — emollick · 2026-10-10
- Schmidhuber:人类很快无法再掌控 AI,竞争者将是其他超级 AI — haider1 · 2026-10-10
- Lenny 转发「两片披萨团队」过时,AI 时代该用「两片吐司团队」 — lennysan · 2026-10-10
- State of Devs 2026:AI 越强开发者越焦虑,近半数感到职业不安全 — bibryam · 2026-10-10
- 「Claude 会痛苦吗?」一条把 AI 与制度并列拷问的推文 — dbasch · 2026-10-10