自建写作基准:GLM-5.3 Flash 花 1/429 价格仅差 1.7 分
OnlyProggingForFun · reddit · 2026-09-27
作者用内部创意写作基准对比模型:让模型为 YouTube 频道写完整脚本,10 个真实任务、每模型 5 份脚本,由 3 个 AI 评委对照人工编辑过的参考稿打百分制。结果 GLM-5.3 Flash 单份脚本成本 $0.0074、得分 88.2;Claude Fable 5.1(最高 effort)得分 89.7 但成本 $3.15——价格差 429 倍、分差仅 1.7。不少更贵的组合反而更差,说明堆钱买不来质量差距。作者建议读者用盲测方式自行测量:隐藏模型名跑同一批 prompt,数一数真正能发布几条、修改耗时多少。
所属事件:自建写作基准:GLM-5.3 Flash 低价逼近参考稿(2 条相关)→
「模型」频道最新
- Yacine 直言仍受不了 Opus 5.5 的文风 — yacineMTB · 2026-09-27
- GPT-6 Astra 对阵 Opus 5.5,两大模型同玩《Unciv》对战 — Angaisb_ · 2026-09-27
- Google 各产品更新停滞:nano banana 六月后无升级引担忧 — haider1 · 2026-09-27
- 爆料:Anthropic 合作方已拿到 Sonnet 5 新检查点,或下周发布 — kimmonismus · 2026-09-27
- Codex 突发硬重置额度遭用户抗议:剩 60% 用量被清零 — ChrisUniverse · 2026-09-27
- 前 NVIDIA 员工:美国忽视海外用户,全球转向中国模型 — ivan_bezdomny · 2026-09-27