Mike Frank 调整模型推理档位:聊天用 High 而非 Max,权衡速度与思考时长
MikePFrank · x · 2026-09-15
Mike Frank 在讨论其模型的推理强度配置:打算把聊天场景从 Max 思考档调回 High,因为 High 响应更快。他还考虑把每步目标推理时间压缩到 1 分钟左右——他指出 OpenRouter 上该模型的供应商吞吐约 100 tokens/秒,1 分钟约 6000 tokens,感觉这个模型完全能用满这些思考量,模型本身偏冗长的输出也是慢的原因之一。
所属事件:Mike Frank 实测模型下棋推理时长调参,聊天拟降为 High 档(2 条相关)→
「模型」频道最新
- 孪生素数界从246推进到188,GPT-6 Astra发布前夕再推至186 — RexDouglass · 2026-09-15
- OpenAI 桌面端语音降价约 60%,ChatGPT 语音时长扩至 2.4 倍 — athyuttamre · 2026-09-15
- 多家实测 high 档反超 max,博主批厂商刷分后包装最佳实践 — karminski3 · 2026-09-15
- Qwen3.8 27B 鹈鹕测试:0.21 美元跑出付费模型 3 美元效果 — DivideHorror3217 · 2026-09-15
- LlamaIndex 回击 Cohere Parse:Cohere Parse 五维基准仅约 50% 均分 — ravithejads · 2026-09-15
- DeepSeek 算子工程师自述:明知 AI 将取代自己,仍选择亲手加速这一进程 — WebAssemblyMan · 2026-09-15