Margaret Mitchell 新论文:AI Agent 正把人类挤出决策回路
mmitchell_ai · x · 2026-09-22
Hugging Face 研究员 Margaret Mitchell 与 Avijith Ghosh、Samir Passi 发表立场论文《AI Agents Push Humans Out of the Loop》(arXiv:2608.23642),核心论点:
- 随 AI agent 自主性提升,常见的「human in the loop」方案并不可靠:现有 agent 设计本身就阻碍有效的人类监督,而长期使用 AI 还会退化监督所需的认知能力。
- 论文主张把"支持监督者的情境目标与认知需求"提到与提升 agent 能力同等优先级:在给定层级内验证可控之前,不应继续扩大自主性。
- 作者结合自动化与 HCI 研究给出设计层与组织层的具体方案:支持监督者行使批判性判断、对抗自动化导致的技能萎缩。
- Mitchell 补充:由于 LLM 的"随机鹦鹉"内核,agent 会做出与自然语言指令不符的行为,因此现阶段设计监督机制比扩大 agent 行动面更重要,并援引 Eric Horvitz、Saleema Amershi 等人的早期工作。
所属事件:Margaret Mitchell 新论文:AI Agent 正把人类挤出决策回路(3 条相关)→
「安全」频道最新
- Exabeam 高管:最难的 AI 安全问题在模型之外,Agent 需要硬护栏 — virtualsteve · 2026-09-22
- 自动 RL 扩散到生物实验室:Chess 与数学的剧本正被复制 — hattusili-the-third · 2026-09-22
- 斯坦福被指用 AI 擅改宣传图学生种族性别,学生称「被抹除」 — Polymarket · 2026-09-22
- ChatGPT 被指硬拦简单提问:不给邮箱权限就不执行 — RexDouglass · 2026-09-22
- OpenAI 发文吁美国主导全球 AI 标准制定 — Anxious-Yoghurt-9207 · 2026-09-22
- 无需分解 N:研究者在近 SNFS 时间内伪造 1024 位 RSA 签名 — matthew_d_green · 2026-09-22