OpenAI 高 Token 效率或源于训练预算感知

teortaxesTex · x · 2026-08-27

针对 OpenAI 模型(如 Luna)相比同类模型(DSV4-flash, GLM5.3-flash)Token 消耗低 40% 的现象,TeortugasTex 提出推测:这可能与模型对“努力控制”(effort control)的良好响应有关。他认为 OpenAI 可能在训练阶段投入了大量算力来训练“预算意识”,作为一种隐式的长度惩罚,从而实现了“多付多得”且整体更高效的效果。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →