AI 从业者质疑用 ARC-AGI 当基准:严重的品味问题
HanchungLee · x · 2026-09-07
X 用户 Hanchung Lee 发帖批评以 ARC-AGI 作为模型能力基准的做法,称这是「严重的品味问题」,并附上相关讨论链接。这一表态引发了关于 AGI 存在与基准有效性的争论:有回复者直言「尽管欣赏黄仁勋,但这次他确实错了」,争论焦点围绕 AGI 是否存在以及 ARC-AGI 这类基准能否真正衡量通用智能。
「模型」频道最新
- Gary Marcus 引述实测:Astra 规划最强,写代码却频繁出错 — GaryMarcus · 2026-09-07
- GPT-6 Astra传闻:1.2T活跃参数,超150T token训练 — teortaxesTex · 2026-09-07
- Reddit 梗图调侃:Google 可能嫌 Gemini 4 Pro 不值又去卷 Flash — Able-Line2683 · 2026-09-07
- Astra 机器人控制演示频出,传 OpenAI 正自研类 Gemini Robotics 模型 — CyberRobooo · 2026-09-07
- 教授用 Astra 一小时写出五份 NIH 百万美元级科研基金申请书 — mmbronstein · 2026-09-07
- GPT-6 Astra 零样本指挥机械臂分拣异形积木引猜测 — CyberRobooo · 2026-09-07