Grok 4.6 登顶 ARC-AGI-1,推理成本远低于竞品
elonmusk · x · 2026-08-14
据 ARC-AGI 官方测试数据,xAI 的 Grok 4.6 在 ARC-AGI-1 取得 87.5% 的准确率,单次任务成本仅 0.30 美元。在最难的 ARC-AGI-3 测试中,其成绩与 GPT-5.6 Sol 相当,但推理成本(5.6K 美元)远低于后者的 15.2K 美元。
「模型」频道最新
- 智谱发布 GLM-5.3:主打编程与网络安全防御 — andersonbcdefg · 2026-08-14
- Reddit开发者实测:用DeepSeek打造超长记忆AI跑团DM,两周成本不到2美元 — zacurryy · 2026-08-14
- 观点:后训练才是大模型能力跃升的核心 — IridiumEagle · 2026-08-14
- 曝 DeepSeek 发布 V4-Pro:1.4T 参数主打 Agent 升级 — drdanielbender · 2026-08-14
- 谷歌高管确认 Gemini 4 预训练中,3.5 Pro 或被跳过 — haider1 · 2026-08-14
- 曝 Grok 4.6 登顶 CursorBench 真实编程测试 — kevinnbass · 2026-08-14