自建写作基准:GLM-5.3 Flash 花 1/429 价格仅差 1.7 分

OnlyProggingForFun · reddit · 2026-09-27

作者用内部创意写作基准对比模型:让模型为 YouTube 频道写完整脚本,10 个真实任务、每模型 5 份脚本,由 3 个 AI 评委对照人工编辑过的参考稿打百分制。结果 GLM-5.3 Flash 单份脚本成本 $0.0074、得分 88.2;Claude Fable 5.1(最高 effort)得分 89.7 但成本 $3.15——价格差 429 倍、分差仅 1.7。不少更贵的组合反而更差,说明堆钱买不来质量差距。作者建议读者用盲测方式自行测量:隐藏模型名跑同一批 prompt,数一数真正能发布几条、修改耗时多少。

所属事件:自建写作基准:GLM-5.3 Flash 低价逼近参考稿(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →