OpenAI 模型在 ARC 类谜题上输给 Meta 的 Muse
BLUECOW009 · x · 2026-10-07
BLUECOW009 感叹:OpenAI 的 dots 在谜题类基准上输给 Meta 的 Muse,这一结果出乎意料。帖子反映两家公司在推理/抽象谜题类能力上的竞争出现反转,值得后续关注具体评测数据。
「模型」频道最新
- OpenAI 开源前沿模型产出的 722 篇数学手稿与推理轨迹 — gdb · 2026-10-07
- 前 Google 员工质疑 Gemini Live 语音助手 Astra 疑被量化降质 — joannejang · 2026-10-07
- 16GB 显存跑 Swift 量化版:50 tps 实测后还能再压量化吗 — royalflash417 · 2026-10-07
- 传 OpenAI 在黎曼猜想上取得突破,作者讽人类纯度攀比 — ipeirotis · 2026-10-07
- Jev 模型当 LLM 裁判:一致性提升 Agent 评测可靠性 — omarsar0 · 2026-10-07
- X 推文 @bot 标记上线:回复即可存 Notion、定提醒、总结线程 — tetsuoai · 2026-10-07