5.6 Sol 推理很强,却不会把结论讲给人听
jarrodwatts · x · 2026-08-04
作者认为,5.6 Sol 的推理能力很强,但它把想法讲给人类听的能力很差。
更有意思的是,作者感觉它似乎特别擅长和“另一个自己”沟通。
帖子最后抛出的判断是:也许真正的瓶颈不是模型,而是人类用户。
「模型」频道最新
- Google 让 Gemini 3.5 Flash/3.6 Flash 同时用 Maps 和 Search — OfficialLoganK · 2026-08-04
- DeepSeek V4 Flash 以 35 倍低成本登上 Vals 高分榜 — zephyr_z9 · 2026-08-04
- gpt-oss-20b 在任务上碾压 Opus,且便宜千倍 — scaling01 · 2026-08-04
- Vibe Code Bench:V4 Flash 以更低成本略胜 GLM 5.2 — teortaxesTex · 2026-08-04
- Claude 会讲高阶数学,却把飞行速度表做崩了 — Recent-Day3062 · 2026-08-04
- Celeris-1 自称每秒 2038 个 token,登顶速度榜 — Scobleizer · 2026-08-04