学生实测:Opus 与 ChatGPT 先狠批幻灯片,见原始材料即改口

Kazoru4 · reddit · 2026-09-16

一位学生分享用 AI 做教科书阅读展示的经历:先用 NotebookLM 分节总结阅读材料和幻灯片,效果尚可但仍有古怪错误;再用 Opus 5 和 ChatGPT 5 Luna 审阅时,二者把成果批得一文不值——缺因果、全错;但上传原始教材后,它们立刻改口承认幻灯片符合教材事实,随后又开始挑剔无关痛痒的小细节以显得聪明,对改进毫无帮助。

作者感叹最新模型「以前靠过度附和来幻觉,现在靠挑剔小事来幻觉和 gaslight」,并据此质疑「AI 太危险」的叙事,认为 LLM 推理仍然很笨;他认同放缓开发的必要性,但理由是数据饱和下模型反而变笨,需要不同的发展方向。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →