38 模型 107 档推理强度实测:写文案高推理值不值 20 倍价钱

OnlyProggingForFun · reddit · 2026-09-27

作者在其内部写作基准上测试了 38 个模型、共 107 档推理强度设置(含 Opus 5.5、Fable 5.1、GPT-6 Sol/Astra/Luna),用同一批 10 个真实 YouTube 脚本、三名评委盲评打分,回答一个问题:写作为什么值得更高的 reasoning effort?

主要结论:

实用建议:大批量写稿别默认拉满,找到自己预算下曲线趋平的位置;只要最好且不在乎账单,Opus 5.5 max 是测过的最强写手(仅 max 和 xhigh 两档能达到作者自己脚本的水平)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →