gpt-6-luna 决策榜仅列第 25 名,成本却高 2.3 倍
antoine_chaffin · x · 2026-10-07
HF 团队的 antoinechaffin 调侃生成式模型当「决策模型」花大钱办小事:据 multimodalart,gpt-6-luna 在 jev decision index v0.3 仅排第 25 位,成本还是 jev 的 2.3 倍。
他的观点是:决策模型(非生成式分类任务)不该只是生成式模型的套壳,而他们排名在 jev 之前的模型是开源的,可本地运行或用低价 API。
「模型」频道最新
- 温度设 0 也非确定输出:batch 形状与 kernel 归约顺序都影响 logits — JFPuget · 2026-10-07
- 付费用户炮轰 OpenAI:少搞重置,多回应客户、把模型做好 — AirportEither2456 · 2026-10-07
- 实测:GPT-6-luna 用 API 每 effort 档能多给推理 token — LysandreJik · 2026-10-07
- Bug Hunt 实测:GPT-6.1 Sol 能翻盘修复, Muse 系仍是最便宜主力 — PawelHuryn · 2026-10-07
- 博主自烧订阅算出倍率:SuperGrok 80x、Muse Power 137x 用量杠杆 — PawelHuryn · 2026-10-07
- OpenAI 数学证明发布后,r/mathematics 社区反应两极 — petburiraja · 2026-10-07