用户实测称新模型 Sol 写作与推理质量明显跃升
dreamwieber · x · 2026-09-26
用户 dreamwieber 评价名为 Sol 的模型在写作和推理质量上「实打实的进步」,认为写作一直是 LLM 讽刺地仍未攻克的能力。他还顺带提到好奇 Opus 5.5 是否有改进,因为在他看来连 Fable 的写作都还比较粗糙。
「模型」频道最新
- 博主实测:Opus 5.5思考越强成绩越差,Max档成本暴涨精度反降 — davidyin44 · 2026-09-26
- LibertAI 开源 Deem 9B:基于 Qwen3.5,基准落后 Jev 约 5 个点 — Pokenhagen · 2026-09-26
- Peter Steinberger:编码不用 Claude,靠 Codex 加 OC harness — steipete · 2026-09-26
- Anthropic 数学解题落后 OpenAI,算力储备或是主因 — haider1 · 2026-09-26
- Opus 4.6 对比 Opus 5.5:实测两代模型生成 Hytale 世界观 — Angaisb_ · 2026-09-26
- OpenAI 持久化 agent 或命名「o」,旧品牌报道再被翻出 — Dullydude · 2026-09-26