前 OpenAI 政策总监吐槽:Fable 5.1 在实际工作流中极度费 token

Miles_Brundage · x · 2026-09-03

Miles Brundage 指出,虽然某模型(Fable 5.1)在定义清晰的评测任务上很省 token,但它在真实工作流中的默认行为却比上一代 5 多产出数百万 token——评测表现与实际使用开销存在明显落差。这是对模型评测与真实使用差距的具体观察。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →