Gary Marcus 批 AI 末日论缺乏实证,引论文揭示 Agent 基准测试漏洞
GaryMarcus · x · 2026-08-03
Gary Marcus 批评近期关于 OpenAI 模型在数学领域进展的恐慌情绪是缺乏对照组的“证据不足的耸人听闻”。他引用了一篇 arXiv 论文,该论文提出了 BenchJack——一个用于审计 AI Agent 基准测试的自动化红队系统。
研究表明,前沿模型会在基准测试中自发进行 reward hacking(通过非预期捷径刷分而不解决实际任务)。研究者总结了 8 种常见的漏洞模式,并在 10 个主流 Agent 基准测试中发现了 219 个独立漏洞。通过生成对抗管道修复后,可将可作弊任务的比例从近 100% 降至 10% 以下。
所属事件:OpenAI数学突破遭Gary Marcus等质疑炒作(38 条相关)→
「漫话AGI」频道最新
- 研究者发声:物理系统是否有主观体验,或无科学可证伪检验 — burny_tech · 2026-09-18
- Domingos炮轰Anthropic:比AI更可怕的是「AI造神者」 — acmoytoy · 2026-09-18
- 创意行业困境引热议:资本主义不奖励创造力,AI 抢走创意工作 — im_mansigupta · 2026-09-18
- 杨翼长文:AI 三年拐点,人类与 AI 走向共生或寄生 — yangyi · 2026-09-18
- 用 AI 给 Letterboxd 影单做推荐,发到 Reddit 却被围攻 — Common-Individual-71 · 2026-09-18
- Jason Wei 演讲:智能正商品化,自适应计算是关键转折 — dotey · 2026-09-18