前 OpenAI 政策总监吐槽:Fable 5.1 在实际工作流中极度费 token
Miles_Brundage · x · 2026-09-03
Miles Brundage 指出,虽然某模型(Fable 5.1)在定义清晰的评测任务上很省 token,但它在真实工作流中的默认行为却比上一代 5 多产出数百万 token——评测表现与实际使用开销存在明显落差。这是对模型评测与真实使用差距的具体观察。
「模型」频道最新
- GPT-6 Astra 在 Minecraft 里做出 OpenAI 标志变形动画屏 — Angaisb_ · 2026-09-05
- Polymarket 开盘赌 OpenAI「GPT Astra 6.1+」年内能否发布 — Polymarket · 2026-09-05
- 小模型排行更新:Ling 3.0 Tiny 以 1.3B 激活参数领跑 — Tall_Abrocoma_3533 · 2026-09-05
- 用户反映 Codex 额度消耗明显变快,发出集体求证 — xiaohu · 2026-09-05
- Gemini 3.1 Pro 处理 R18 故事时彻底崩溃翻车 — Extreme_Rate_681 · 2026-09-05
- AA Frontier 榜单更新:Qwen3.8-27B 成榜单宠儿 — Tall_Abrocoma_3533 · 2026-09-05