GLM-5.3 替代 Fable:分数涨 11 点成本降一半
zainhas · x · 2026-08-23
用户评测发现,若先运行 GLM-5.3 并仅在验证失败时升级至 Fable,可达到 81.1% 的成绩,单任务成本仅 $10.74。相比单独使用 Fable,该方法分数提升 11 个点,成本仅为一半。数据显示两者行为高度相关(相关性 0.65),建议直接用 GLM-5.3 替代 Fable。
「模型」频道最新
- 新证据称 ox-alpha 并非 GLM:该模型支持视频输入 — qinzytech · 2026-08-23
- GigaCEM 创始人:开源压力下前沿模型价格将降 10 倍 — bindureddy · 2026-08-23
- Sol 模型在绘图代码生成实测中表现优于 Fable — suchenzang · 2026-08-23
- Opus 5 被曝逼近 Anthropic 内部水平,擅长目标优化 — scaling01 · 2026-08-23
- DeepSWE 实测:GLM-5.3 成本仅为 Fable 5 的 1/4 — zainhas · 2026-08-23
- Ox Alpha完整DeepSWE跑出63%,或为GLM-5.3 Flash — kimmonismus · 2026-08-23