ChatGPT在基础算法题上频频逻辑幻觉
ReasonableSociety945 · reddit · 2026-07-06
用户反映ChatGPT在做最短作业优先(SJF)调度计算时,给出的表格看似完美却完全忽略了进程到达时间;求Product of Sums却给成Sum of Products;甚至把本应是2n的复杂度说成2^n。
用户调侃自己花在调试它"逻辑幻觉"上的时间比手算还多,并询问是否有可靠的提示词结构能让它真正遵守严格约束。
「模型」频道最新
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27