创意写作新横评:作者偏爱 Muse Spark,称 Fable 已患Claude腔
koltregaskes · x · 2026-09-07
博主 sampaech 对一批新模型做了创意写作测试,涉及 GPT-6-Astra、Fable 5.1、Muse Spark 1.3、Gemini 3.8 flash 等型号。其主观结论是:Muse Spark 1.3 表现最好,能按用户要求写、不会强加统一的"house style";Fable 5.1 则收敛出一种类似 Claude 的固定腔调(claudeslop),已无法正常写作;GPT-6-Astra 似乎也失去了自然写作能力。回复者 koltregaskes 感慨:这意味着以后不能再凭创意写作基准来判断模型的真实写作水平。注意:这些型号未获官方确认,评测为主观感受。
所属事件:EQ-Bench 作者横评新模型创意写作:Muse Spark 1.3 最听话(5 条相关)→
「模型」频道最新
- 哲学家请 GPT-6 评自己的牛津新书:水准达顶刊书评 — anselm · 2026-09-07
- 爆料:xAI 正筹备 Grok 4.7,「可能还有惊喜」 — mark_k · 2026-09-07
- 本地 LLM 已逼近 Opus,真正的差距到底卡在哪? — mrsalvadordali · 2026-09-07
- 12 模型「AI 味」盲测:Fable 5.1 仅 14% 被判 AI,Gemini 3.8 达 77% — PawelHuryn · 2026-09-07
- 用户怀念爱用 Emoji 的旧版 Claude:新版本文风变得过度诗意 — JoshuaJosephson · 2026-09-07
- Astra 自估距 AGI 很远,但配上工具使用后评分接近 — kevinnbass · 2026-09-07