用户实测 Claude Haiku 写数学题连错三次,被迫回头用 Opus
joshh0444 · reddit · 2026-09-11
一位 Reddit 用户分享用 Claude Code 给网站出数学题的经历:本以为杂活可以交给小模型 Haiku,结果它在生成代数题时反复翻车——先算出答案与选项不符(x=3.25 不在选项里),修订后再次算错(答案是 3 却标 D),第三次仍出错,最后主动求助用户。作者感叹不得不用 Opus 重做,质疑「杂活默认用小模型」的建议是否可靠。
「模型」频道最新
- SuperGrok Heavy 用户将抢先体验最前沿功能 — Baconbrix · 2026-09-12
- Qwen3.8-27B 登陆 Cerebras,以极速推理跑出旗舰级成绩 — Scobleizer · 2026-09-12
- Astra 承认质量劣化:实验致 4000-5000 用户受影响,三项问题已修复 — TheMoonMidas · 2026-09-12
- 网友实测称 Gemini V4.1 知识截止疑至 2026 年 1 月 — teortaxesTex · 2026-09-12
- 爆料称谷歌逼近递归自我改进,或赶在 Anthropic 与 OpenAI IPO 前官宣 — beffjezos · 2026-09-12
- 开发者实测称 DeepSeek v4.1 Flash 明显优于 Gemini Flash — gaganghotra_ · 2026-09-12