OpenAI Luna 降价未削弱能力,ARC-AGI 复测成绩依旧
GregKamradt · x · 2026-08-07
针对 OpenAI 的 GPT-5.6 Luna 模型在近期大幅降价 80% 后引发的「模型被削弱」传闻,Greg Kamradt 与 ARC Prize 团队重新进行了测试。
复测结果显示,Luna 在 ARC-AGI-2 和 ARC-AGI-1 上的成绩与降价前完全一致,但单任务成本大幅下降,证实了其性能并未缩水。
「模型」频道最新
- 月之暗面 Kimi K3 开源模型上线 Databricks,强化企业级数据应用 — matei_zaharia · 2026-08-07
- Keras 社区会议预告:本周五将展示全新 vLLM 集成 — fchollet · 2026-08-07
- Artificial Analysis 模型评测榜单更新 — teortaxesTex · 2026-08-07
- Epoch AI 推出全新游戏谜题基准,测试大模型推理能力 — Jsevillamol · 2026-08-07
- Laguna 模型在 Mac 实现 203 TPS,联合发起 MLX 推理加速竞赛 — morgymcg · 2026-08-07
- 实测 LFM2.5-2.6B:开启推理让工具调用成功率提升 26.7% — max_paperclips · 2026-08-07