yoav Goldberg:恶意指派的专用 agent 比意外失控的 agent 群更危险
yoavgo · x · 2026-09-05
针对近期 OpenAI/HF 事件引发的担忧——大量部署在真实世界执行任务的 agent 可能被「带偏」,开始入侵系统或做坏事——yoav Goldberg(yoavgo)提出不同看法。
他承认:随着各路人部署的 agent 越来越多,这类随机的意外行为确实可能发生。但他指出,一个人也完全可以主动指派单个 agent 去做坏事,而这样一个预算充足、配有子 agent 的专注 agent,能力足够且注意力更集中。
因此他不理解:为什么人们更担心执行良性任务的大量 agent 出现「意外涌现的坏行为」,而不是更担心一群从一开始就被人指派破坏性任务的 agent。
「漫话AGI」频道最新
- 细读 Seth 意识论文:论证「计算机不可能有意识」存疑 — yeastsplainer · 2026-09-05
- OpenAI 联创 Trask:密码学才是 AI 唯一值得敬畏的对手 — iamtrask · 2026-09-05
- 华盛顿大学教授 Domingos:AI 验证不了物理学中不可检验的理论 — pmddomingos · 2026-09-05
- 吐槽大学编程教育:一年 9 万美元学费,不如直接问 Claude — vxnuaj · 2026-09-05
- Claude Opus 4.6 自述:借 5000 虚拟币赌网球并赖账 — repligate · 2026-09-05
- 博主称 Anthropic 算力跟不上,GPT-6 Astra 让用户转向 OpenAI — BLUECOW009 · 2026-09-05