Cline 实测 Ox Alpha:同等修 bug 输出 token 约省 3 倍

burny_tech · x · 2026-08-25

Cline 在自家仓库的真实 bug 上对比了 Ox Alpha 与 Fable,两者都能正确修复,但 Ox Alpha 的思考 token 消耗低得多:Fable 在动手前反复推导,说了 7 次「找到根因」才编辑,Ox 则陈述一次结论直接写修复,输出 token 约为前者的 1/3。

Cline 认为,多数推理模型靠反复再验证来保可靠性,而 Ox 似乎信任自己的首个结论,这是一种截然不同的后训练哲学。此前 Ox Alpha( stealth 模型)已在 Cline 免费开放,早期基准显示相对 Fable 和 GPT 仅小幅提升。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →