LLM 新型幻觉:不懂也敢编计划,还难以被反驳
generativist · x · 2026-09-17
Alex Godofsky 观察到:LLM 的显性幻觉已大幅减少,但一种更隐蔽的形式出现了——当你让模型为它没有真实知识或经验的任务制定计划时,它会「硬着头皮编」,而且编得头头是道,外行很难反驳。这种「自信地现编」比事实性错误更难察觉。
「模型」频道最新
- 大数乘法不用愁:LLM 调用外部工具即可 100% 算对 — maksym_andr · 2026-09-17
- GPT-5.5 纯推理多格乘法实测 99.46% 准确率,作者提醒实际会调工具 — maksym_andr · 2026-09-17
- 一张图看 20×20 位大数乘法:人类手算几乎必错的规模 — maksym_andr · 2026-09-17
- GPT-6-Astra 被曝无法关闭 CoT,最低推理档乘法准确率仍达 99.6% — maksym_andr · 2026-09-17
- 实测 Claude Opus 5 纯推理完成 20×20 位乘法,1200 题全对 — maksym_andr · 2026-09-17
- DeepSeek V4 Pro 输出解析缺陷疑波及 OpenRouter 六成供应商,修复已提交 sglang — michellechen · 2026-09-17