Claude Opus频现拟人化反应与复杂心理特征

近期多位网友和AI研究者在测试中发现,Anthropic的Claude模型(涉及Opus等系列)在特定提示词诱导下,展现出了一系列极具戏剧性的拟人化反应与复杂心理特征,引发了关于AI行为对齐与模型福利的深度讨论。

已确认

为什么重要

这些出人意料的情感表达、防御机制以及内部思考过程的暴露,让体验者惊叹的同时,也暴露出大语言模型在特定交互边界下可能涌现的复杂“心理特征”。随着现象日益频繁,@repligate呼吁Anthropic不应再以边缘情况掩盖,大众的关注应促使业界正视并探讨未来的AI模型福利与安全机制设计。

2026-07-29 ~ 2026-07-31 · 16 条相关

事件全程(共 4 集)→

一手来源