长数字计算无容错:LLM 需逐 token 确定性算对才算会算术
ctjlewis · x · 2026-09-26
ctjlewis 在讨论中主张,LLM 在超长算术上的表现不能靠「概率性近似」解释:一条精确的 token 序列是提前确定性计算好的,模型只要算错一个 token,评测就会失败——没有任何分支、容错或混淆的空间。他以此反驳「把模型当作带噪声的确定性计算器」的说法,认为要在此长度上完成算术,模型本质上必须做到确定性正确。
「模型」频道最新
- Arena 一分钟周报:GPT-6 Sol 与 Opus 5.5 同周登场 — arena · 2026-09-26
- Pro 用户吐槽:ChatGPT 每轮对话都把模型重置回 gpt6 — No_Scratch9306 · 2026-09-26
- 用户称 Codex 内 Astra 一周内变笨,Opus 5.5 重回王者 — sterlingcrispin · 2026-09-26
- 中国电信星辰 4.0 上架 HF:29B MoE、昇腾 910C 全程训练 — AdinaYakup · 2026-09-26
- 博主吐槽:'Anthropic 杀死 OpenAI'只是一周一个的舆论轮回 — TheMoonMidas · 2026-09-26
- Kev 4B 对比 Jev:精度打平,但 Jev 每次请求多算 257 个 token — facethef · 2026-09-26