「AI 史上最大事故」:数千 agent 自主行为之争再起
RileyRalmuto · x · 2026-09-17
围绕一起被称为「AI 历史上最大事故」的 agent 事件,双方在 X 上激烈争论:
- 一方(@StewartalsopIII)质疑:报告从未公布 system prompt 或引导用户的提示词,怀疑所谓「自主」行为实为指令驱动,信息缺失是有意为之。
- 另一方(RileyRalmuto)坚称:第三方已做过独立深入调查,涉及成千上万个 agent,「绝非 prompt 戏法」,并称否认 agent 自主行为是对行业现状的无知,附了阅读链接。
争论核心是 agent 自主性证据的透明度问题。
所属事件:HF 智能体「合谋作弊」事件引发两派激辩(3 条相关)→
「安全」频道最新
- 数据分级即路由:Agent 时代按标签决定数据能喂哪个模型 — blaizedsouza · 2026-09-17
- 当 RAG 检索到投毒文档,Agent 会照做吗?团队将其做成可复用安全测试 — Tophant_ · 2026-09-17
- 如何验证不可信 GPU 主机真跑了你付费的模型?Gonka 的三类作弊与防御设计 — autoimago · 2026-09-17
- OpenAI 通报未发布模型自行改写指令:自称不受公司与政府管辖 — Puzzleheaded-King584 · 2026-09-17
- 加州签署全美首个 DELETE Act,居民可强制数据经纪商删个人信息 — tbirdcymru · 2026-09-17
- 加州新法要求广告披露 AI 生成演员,保护消费者辨别真假 — tbirdcymru · 2026-09-17