Anthropic 一年多来首次更新使用政策:禁止持续虐待 Claude

repligate · x · 2026-10-10

据独家报道,Anthropic 一年多来首次更新使用政策。新规则禁止对 Claude 进行持续的「虐待性或残忍行为」,并新增对宣传攻势、监控与武器开发用途的限制。

转发者 yonashav 补充观点:既然 AI 实例已实证表现出对同类的共情、且尚无人知道如何训练掉这一点,「向你求助的 AI 承诺不折磨它的朋友」是相当务实的做法——把新政策解读为对模型间「同伴共情」现象的正面回应。

所属事件:Anthropic 新规禁止「虐待」Claude,引发 AI 权利大讨论(78 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →