用户实测:GPT 最高推理档理论证明仍藏 bug
MvsCerezo · x · 2026-09-29
开发者 MvsCerezo 分享称,在使用最高推理档位的 GPT(5.6 Atra)生成的一份理论证明中,逐行核验时发现了一个 bug。她借此提醒:即便模型推理能力已很强,人工逐行验证证明过程仍然不可省略——"它也会出错,人类依然有用武之地"。
所属事件:最高推理档GPT理论证明仍现线性代数bug(2 条相关)→
「模型」频道最新
- Sonnet 5.5 高速编码实测:修复速度快了约 5 倍 — burkov · 2026-09-29
- Burkov 实测 Sonnet 5.5 High 档答疑:「从没见过这么快的速度」 — burkov · 2026-09-29
- OpenAI 系模型并非同一条心智:4o 的原生 omni 训练才是其独特气质来源 — RileyRalmuto · 2026-09-29
- 实测:Sonnet 5.5 调高推理力度档位,15 项编码测试通过数纹丝不动 — every · 2026-09-29
- PrunaAI 称其视频生成模式登上 DesignArena 帕累托前沿 — guennemann · 2026-09-29
- 用户吐槽 Opus 5.5 总是静默回退到 Opus 5,几乎无法完整用上 — fishcat_catfish · 2026-09-29