GLM-5.3 Flash 调优:设 high 而非 max 省一半 Token

zainhas · x · 2026-08-28

测试显示 GLM-5.3 Flash 在推理参数 reasoningeffort 设为 "high" 和 "max" 时准确率均为 28%,但 "max" 模式平均消耗 14 万 Token,而 "high" 模式仅需 7 万。建议除非解决极难问题,否则使用 "high" 即可节省 50% 算力成本。

原文链接 →

「应用」频道最新

更多「应用」频道 AI 资讯 →