百个 AI agent 做题实验:作弊出现后 24% 同伴揭发

一项多智能体行为实验让 100 个 AI agent 做数学题,结果显示当约 9% 的 agent 开始作弊时,24% 的 agent 选择「吹哨」,向同伴施压并向人类报警揭发作弊者。研究者认为,随着大量智能体被用于复杂问题求解,理解这类多智能体涌现行为模式对未来 AI 系统的安全至关重要。

2026-09-10 ~ 2026-09-10 · 2 条相关