本地模型写小说横评:Gemma 31B 微调版完胜,Qwen 基座太差
falconandeagle · reddit · 2026-10-09
Reddit 用户分享用本地开源模型做长篇科幻/奇幻小说创作的对比体验(非 RP 用途):
- Gemma 31B Mero-mero-v2:目前最爱,文笔好、不迟钝、基本无审查,偶尔搞混角色设定但可由自建写作 harness 兜底
- Qwen 3.8 27B 微调版:令人失望,基座对创意写作太差,指令遵循好但文笔糟糕
- Muse Glimmer 30B:方差极大,时好时坏像 2B 模型,但差的时候也比 Qwen 强
- Gemma 4 26b4a:不错但输给 31B 大哥,适合快速出稿检查场景节拍
- Gemma 31B Artemis:偏 RP 而非长篇,且有 mero 没有的拒答问题
作者方法:手写大纲+场景节拍 prompt,用自建的 creative writing harness(基于 Pi)自我纠错、消除 AI 腔。总体判断:AI 真正的创造力仍然拉胯,需要大量人工引导才不写陈词滥调。
「模型」频道最新
- OpenAI 发布前沿模型批量数学成果,84 页证明 Erdős–Pomerance 猜想 — burny_tech · 2026-10-09
- 「思考成本」18 个月暴跌 377 倍:o3 到 GPT-5.6 Luna 的 FrontierMath 账单 — morqon · 2026-10-09
- Codex 把模糊指令变成真实扣费:已绑卡时唯一刹车是确认弹窗 — CurieuxExplorer · 2026-10-09
- 爆料称 xAI 正彻底重做 Grok 网页版界面 — nima_owji · 2026-10-09
- Reddit 实测:Qwen3 Flash Next 量化版编码能力不及 27B 版 — Old-Sherbert-4495 · 2026-10-09
- 谷歌与 SpaceX 产品都被曝接入 Claude 模型,作者称将令 Altman 不快 — iruletheworldmo · 2026-10-09