研究者称 ARC-AGI 已失意义:单模型 scaling 冲 AGI 叙事破产
gerardsans · x · 2026-10-03
X 用户 gerardsans 在与 Chollet 相关的讨论中抨击 ARC-AGI 评测,认为其前提来自前几个炒作周期,已失去实质相关性。
核心论点:
- ARC 新版评测引入 agentic workflow,但这只是原始叙事的妥协:靠单个模型 scaling 直达 AGI 的路线已经失败,「这些都没有存活下来」。
- 评测 harness(外层框架)本身并非突破,而是「把 transformer 的所有短板写成了代码」:循环和算法取代推理成为真正的主角,与旧的「模型智能」故事不再匹配。
这是一条典型的 AI 圈观点争论,针对评测哲学与 AGI 路线之争,虽是个人观点但话题有传播度。
所属事件:研究者称 ARC-AGI 基准已失去意义(2 条相关)→
「漫话AGI」频道最新
- 不到 3% 美国人用 AI,网友惊呼「我们还处在极早期」 — JHochderffer · 2026-10-03
- X 高管用 AI 定制狗门:不懂金属加工也能两周交付,成本接近量产货 — nikitabier · 2026-10-03
- Atlassian 调研:80% 产品团队用 AI 提速交付,决策却没变快 — aakashgupta · 2026-10-03
- repligate:别给持续型 agent 强推模型更新,去建生态 — repligate · 2026-10-03
- 前 Google 研究员预测几年内模型将超越全人类能力 — zetalyrae · 2026-10-03
- OpenAI 高管:AI 的终极成就是加速科学发现这台机器本身 — shyamalanadkat · 2026-10-03