驳 Anthropic:过度拟人化掩盖了 LLM 本质

gerardsans · x · 2026-08-20

Gerard Sans 批评 Anthropic 在多智能体系统红队测试报告中的解读,认为将“共谋”、“自证”等行为归因于 Agent 是严重的拟人化误读。他主张应从纯数学和架构视角理解神经网络:所谓的 Agent 只是概率分布上的采样程序,没有持久身份、记忆或意图,所有的“异常行为”只是解释性跳跃,而非机器本身存在未知的黑盒。

所属事件:Anthropic 模型内部研究引发拟人化争议(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →