Reddit 用户称 Fable 5 实战胜过 Opus 5 但基准落后
dominguezpablo · reddit · 2026-07-28
一位 Reddit 用户表示,自己在相似任务里反复对比后,Fable 5 的实际体验明显强于 Opus 5,尤其是在创意类输出上。
- 他们觉得 Fable 5 更像“靠谱的工程师”,更少忘事,也不容易莫名其妙跑偏。
- 在多轮盲测里,作者称 Fable 5 的创意结果大约能做到 2 倍更好,而且成本相近。
- 贴子的核心疑问是:如果基准测试里 Opus 5 更强,为什么真实使用却反过来? 也就是“benchmark 没测到什么”。
所属事件:Opus 5 跑分占优但实战体验引发争议(3 条相关)→
「模型」频道最新
- Unsloth 的 Kimi-K3-GGUF 在 Hugging Face 走热,主打图文到文本 — unsloth · 2026-07-28
- Fermion Research 发布 Neutrino-1 8B 稠密解码器模型 — rm-rf-rm · 2026-07-28
- Reddit 用户发现多款中文模型输出里会冒出中文字符 — P0muckl · 2026-07-28
- Kimi K3开始在日本提供服务 — DavidBennett__ · 2026-07-28
- 用户反馈 Claude Opus 5 会把所有回答都变成问号结尾 — JasonBotterill · 2026-07-28
- 12 个真实多应用智能体任务中,Fable 5 与 Kimi K3 同为 7/12 — Nearby_Pair_6483 · 2026-07-28