Mike Frank 调整模型推理档位:聊天用 High 而非 Max,权衡速度与思考时长

MikePFrank · x · 2026-09-15

Mike Frank 在讨论其模型的推理强度配置:打算把聊天场景从 Max 思考档调回 High,因为 High 响应更快。他还考虑把每步目标推理时间压缩到 1 分钟左右——他指出 OpenRouter 上该模型的供应商吞吐约 100 tokens/秒,1 分钟约 6000 tokens,感觉这个模型完全能用满这些思考量,模型本身偏冗长的输出也是慢的原因之一。

所属事件:Mike Frank 实测模型下棋推理时长调参,聊天拟降为 High 档(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →