写作基准实测:GPT-6.1 Sol 比上代倒退 153 Elo,还更慢更贵

OnlyProggingForFun · reddit · 2026-09-30

一个包含 181 个模型配置的内部写作基准(10 个剧本任务、每任务 5 篇、三家实验室的 AI 评委盲评)显示,GPT-6.1 Sol 在写作上是倒退:

结论:写作用 GPT-6 Sol(high/max);非要用 6.1 Sol,low 是便宜之选,xhigh 是最佳档。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →