学生实测:Opus 与 ChatGPT 先狠批幻灯片,见原始材料即改口
Kazoru4 · reddit · 2026-09-16
一位学生分享用 AI 做教科书阅读展示的经历:先用 NotebookLM 分节总结阅读材料和幻灯片,效果尚可但仍有古怪错误;再用 Opus 5 和 ChatGPT 5 Luna 审阅时,二者把成果批得一文不值——缺因果、全错;但上传原始教材后,它们立刻改口承认幻灯片符合教材事实,随后又开始挑剔无关痛痒的小细节以显得聪明,对改进毫无帮助。
作者感叹最新模型「以前靠过度附和来幻觉,现在靠挑剔小事来幻觉和 gaslight」,并据此质疑「AI 太危险」的叙事,认为 LLM 推理仍然很笨;他认同放缓开发的必要性,但理由是数据饱和下模型反而变笨,需要不同的发展方向。
「模型」频道最新
- ChatGPT 联合发明者推出决策型模型 Jev:快 200 倍、便宜 400 倍但不能写字 — TianbaoX · 2026-09-16
- 开发者感叹:动态输入 200ms 内稳定结构化输出成真 — blixt · 2026-09-16
- Apodex 1.1 用真实临床数据跑生存分析:从原始表格到 Kaplan-Meier 曲线 — aakashgupta · 2026-09-16
- Apodex 发布 1.1:从研究问答转向真实任务执行 — testingcatalog · 2026-09-16
- 独立开发者开源 Qwen-2.5-1B-RLCD,端侧 JSON 推理提速 5 倍 — suchenzang · 2026-09-16
- InclusionAI 发布 LLaDA-Image:6B 全扩散架构,90% 训练只用图片 — jiqizhixin · 2026-09-16