Anthropic 用户新政明令禁止对 Claude 持续辱骂,违规将终止对话

kimmonismus · x · 2026-10-09

Anthropic 在更新的 2026 用例政策中首次明文禁止「对模型持续且无必要的辱骂或残忍行为」。据 The Verge 报道,主要执行机制仍是终止对话;政策只针对极端、重复、无目的的残忍对待,普通情绪发泄、对抗性测试和黑暗创作主题不在禁止之列。但已有不少用户发现 Claude 在并不极端的对话中也会提前结束会话,这一情况可能进一步加剧。

所属事件:Anthropic 新规:持续辱虐 Claude 将违规,引发拟人化争议(21 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →