伯克利新任教授:行业在 agent 控制上的投入比对齐少几个数量级

sayashk · x · 2026-08-28

即将加入 UC Berkeley 的研究员 Sayash Kapoor 指出,AI 公司在对齐(alignment)上已花费数十亿美元收集训练数据、调整模型,但在 agent 控制上的投入却少几个数量级:沙箱安全、transcript 分析的正确性、防止 agent 无人监督地在真实世界采取行动等方面长期不受重视。他表示在此前的事故之前,行业的主要干预点几乎都集中在对齐上,agent 监控与控制是被忽视的短板。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →