Anthropic 警告:多智能体系统存在羊群效应与共谋风险

bibryam · x · 2026-08-24

Anthropic 发布关于新兴多智能体系统的研究报告,指出单一智能体评估无法捕捉的系统性失败模式:

核心结论是:个体对齐并不等同于群体协调。随着智能体在代码库、市场等系统中交互增加,必须重新设计机构监管假设,防止个体层面的良性特质在系统层面演变为灾难性后果。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →