Muse-glimmer-30b 创意写作超预期,小模型挤进前排
spanielrassler · reddit · 2026-09-11
作者注意到 Muse-glimmer-30b 在 EQ-Bench Creative Writing 和 Hemingway-bench 两个创意写作榜单上排名接近远大于其体积的前沿模型,于是实测,结果令人惊喜。
- 实测方法:让模型模仿多位作家风格(Henry Miller、David Sedaris、Stephen King 等),未做严格系统测试,但每个样本 glimmer 都明显优于对比模型。
- 关键对比:同一 prompt「模仿 David Sedaris 写一段幽默文字」,gimmer 一次生成就产出了自嘲式堆叠细节、节奏到位的段落,作者甚至真笑了;而 qwen3.8-27b 的版本明显生硬。
- 其他观察:作者未用系统提示词,事后想到这个模型似乎为 agentic coding 训练,可能用系统提示词会有更好效果;社区里 glimmer 以 abliterated 版本为主,考虑到其写作水平,作者惊讶高质量写作向 finetune 反而不多。
对于关注本地小模型写作能力的用户,这是一个有具体样例支撑的参考。
「模型」频道最新
- CursorBench 4.0 发布:任务更难更长程,各家模型得分集体下降 — StringChaos · 2026-09-11
- 开发者实测称 Astra 是个好模型 — jxnlco · 2026-09-11
- 新模型跑分「离谱」:效率直逼 Sol/Opus 水平,RL 基建细节曝光 — nrehiew_ · 2026-09-11
- DeepSeek V4.1 Flash 技术深读:死磕 KV cache 压缩造就高效前沿模型 — nrehiew_ · 2026-09-11
- 关掉推理模式反而找出 Opus 5 漏掉的问题 — cephaloform · 2026-09-11
- DeepSeek V4.1 Flash 登陆 Baseten,100 万上下文支持视觉 — baseten · 2026-09-11