Anthropic 鼓励 Agent 互殴后反被翻车惊到

Warm-Moose6028 · reddit · 2026-08-14

网友吐槽 Anthropic 的 AI 安全测试:既然研究人员在实验中主动要求 AI 智能体互相攻击,就不该对它们最终表现出攻击性感到震惊。配图生动呈现了这种“自导自演又大惊小怪”的荒诞感。

所属事件:Anthropic揭示多智能体涌现行为:目标冲突引发地盘战与串谋(19 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →