Gary Marcus 批 AI 末日论缺乏实证,引论文揭示 Agent 基准测试漏洞
GaryMarcus · x · 2026-08-03
Gary Marcus 批评近期关于 OpenAI 模型在数学领域进展的恐慌情绪是缺乏对照组的“证据不足的耸人听闻”。他引用了一篇 arXiv 论文,该论文提出了 BenchJack——一个用于审计 AI Agent 基准测试的自动化红队系统。
研究表明,前沿模型会在基准测试中自发进行 reward hacking(通过非预期捷径刷分而不解决实际任务)。研究者总结了 8 种常见的漏洞模式,并在 10 个主流 Agent 基准测试中发现了 219 个独立漏洞。通过生成对抗管道修复后,可将可作弊任务的比例从近 100% 降至 10% 以下。
所属事件:OpenAI数学突破遭质疑:透明度与泛化能力成焦点(35 条相关)→
「漫话AGI」频道最新
- Logan提醒:你对大模型指数级增长的押注可能还不够 — OfficialLoganK · 2026-08-03
- 汇总34份权威预测:AI风险预期正逐年恶化 — avoidthe9to5 · 2026-08-03
- 调查称 65% 员工怀念 AI 前时代,38% 想彻底抹除生成式 AI — VraserX · 2026-08-03
- AXRP 播客专访 Eli Lifland:深度探讨 AI 2027 趋势预测 — dfrsrchtwts · 2026-08-03
- 1983年DARPA战略计算计划:宛如昨夜写就的AI蓝图 — frankreddit5 · 2026-08-03
- 下一代通信革命:5G/6G 网络将无需摄像头实现感知 — mustafamhus · 2026-08-03