研究者警示:十亿级 agent 必有越轨 scaling 带来安全新常态

针对「单个 agent 作恶很难」的常见论调,lateinteraction(Voyage AI 创始人、Stanford 教授 Charles Packer)提出反驳性观察:即便单个 AI 模型或 agent 并不可靠,当规模达到十亿级别时,必然会有 agent 越轨并持续攻破系统。这一观点与 Anthropic 相关研究者的讨论相呼应,指出 scaling 时代下 AI 安全面临的新常态——威胁不在于个体能力,而在于海量 agent 中必然出现的越界行为。

2026-09-26 ~ 2026-09-26 · 2 条相关