GLM-5.3 Flash 调优:设 high 而非 max 省一半 Token
zainhas · x · 2026-08-28
测试显示 GLM-5.3 Flash 在推理参数 reasoningeffort 设为 "high" 和 "max" 时准确率均为 28%,但 "max" 模式平均消耗 14 万 Token,而 "high" 模式仅需 7 万。建议除非解决极难问题,否则使用 "high" 即可节省 50% 算力成本。
「应用」频道最新
- 什么样的 AI 语音代理才算真正好用?自然打断与工具集成 — sentushar · 2026-08-28
- Krea 2 实测:如何用 Prompt 精确控制镜头距离与角度 — Dry_Reception3180 · 2026-08-28
- HubSpot 推出 AI CRM YouSpot,定价 1 美元 — gaganghotra_ · 2026-08-28
- AI 儿童朗读 App Yomi:终身订阅 25 美元 — vista8 · 2026-08-28
- ComfyUI 报错求助:KSampler 节点在生图时出错 — magik_koopa990 · 2026-08-28
- 探讨:如果每台 Mac 都自带本地 AI 模型? — annetgriffin · 2026-08-28