最高推理档 GPT 理论证明仍出错,自信坚持基础线代 bug

开发者 MvsCerezo 报告,在使用最高推理档位的 GPT(5.6 Atra)生成的理论证明中逐行核验时发现 bug:出错处并非高深数学,而是量子力学中 GL(d) 群表示论的基础线性代数——模型将「标准」(holonomic)表示论的结果错误外推到「非标准」情形,并在出错后仍自信坚持。她借此提醒:即使模型推理能力已很强,人工逐行核验依然必要。

2026-09-29 ~ 2026-09-29 · 3 条相关