LMArena 将发布 Claude Fable 5 与 5.1 写作清晰度人类评测
arena · x · 2026-09-10
LMArena(arena)宣布已完成对 Claude Fable 5 与 Fable 5.1 两个模型在写作清晰度上的人类偏好排名分析,结果将于当天晚些时候公布,并附投票征集读者猜测哪个模型写得更清晰。
「模型」频道最新
- 弃用 Astra 转投 Sol,5 小时烧光一周额度的用量吐槽 — StewartalsopIII · 2026-09-10
- Claude Pro 用户吐槽:46 美元 API 等价用量即耗尽 98% 周额度 — Angaisb_ · 2026-09-10
- Reddit 用户怒斥 Gemini 与 Claude 免费版暗藏营销式操纵设计 — Cheap-Manner-6164 · 2026-09-10
- 一条 prompt 烧掉 88% 周额度:用户实测发现 sub-agent 用量黑洞 — NanoIsAMeme · 2026-09-10
- 质疑 OpenAI 的 AGI 数字:来自评测框架而非模型本身 — mcraddock · 2026-09-10
- 前沿模型刷爆漏洞利用基准,安全编码基准是否成下一个焦点? — WeldPond · 2026-09-10