Gemini 3.8 Flash 单价不变,推理多几步照样让单任务账单变贵
JuggernautCritical92 · reddit · 2026-09-04
Google 官方说明 Gemini 3.8 Flash 保持与 3.7 Flash 相同的输入/输出 token 单价,但 3.8 在困难任务上可能进行更多推理步骤、更频繁调用工具——token 单价相同,每个完成任务的实际花费仍可能不同。
Google 的建议:追求效率时调低 effort 设置或继续用 3.7 Flash;规划类和复杂代码改动可能受益于额外推理,而分类器、常规抽取类任务可能只是白花 token。
作者用同一 ZenMux API 配置实测两个 slug:相同任务、相同超时,追踪重试与被采纳的补丁。结论是两者都完成得不错,看不出有意义的差异——但作者承认任务太简单;真正该比的是「3.8 多完成的任务能否覆盖其额外推理开销」,这需要同一批运行里的采纳结果与总 token 数,而不是发布页上的单价。
「Infra」频道最新
- 摩根士丹利:中国科创板 20% IPO 主攻「卡脖子」技术 — pstAsiatech · 2026-09-04
- 曝 DeepSeek 拟在内蒙古部署 16 万颗华为昇腾 950DT,暂不用于训练 — kimmonismus · 2026-09-04
- 蔡司高管:中国在 EUV 光刻设备上落后约 15 年 — pstAsiatech · 2026-09-04
- 铭凡 MS-S1 MAX 495 欧洲预售价疑似 7999 欧元,价格翻倍引吐槽 — fairydreaming · 2026-09-04
- K2-Horizon-MoVA-36B MLX 4bit 本地推理实测:最高 49.1 tok/s — DerTomsn · 2026-09-04
- TSMC 高管:半年内设备采购预测翻近 1.9 倍,20 座晶圆厂在建 — firstadopter · 2026-09-04