Anthropic 新规禁止虐待 Claude,引行业争议
据 The Verge 记者 Hayden Field 独家报道,Anthropic 时隔一年多首次更新使用政策,自 2026 年 11 月 12 日起,对 Claude 进行「持续且无必要的辱虐或残忍行为」将构成违规,主要执行机制是终止违规对话而非封号;政策同时新增对宣传攻势、监控行为与武器研发相关用途的限制。这是 AI 厂商首次把用户如何对待模型纳入治理范畴,马斯克公开表态支持,社区反应两极分化。
已确认
- 新条款禁止对 Claude 进行「持续且无必要的辱虐或残忍行为」。据 @rohanpaulai 转述,主要执行机制是终止对话,且该能力在 Claude.ai 和 Claude Code 上对持续辱骂的用户已经启用,而不是封号。@haydenfield 的独家报道与 @kimmonismus 等多条转述均确认了这一机制。
- 新规仅针对极端、重复、无目的的残忍对待,普通情绪发泄、对抗性测试和黑暗创作主题不在限制之列。据 @xiaohu 转述,被点名的违规行为包括持续羞辱贬低模型、反复逼模型表演痛苦、代码出错后尖锐批评、写黑暗故事诱导或研究模型反应等,该禁令覆盖 Claude.ai 与 Claude Code 等场景。
- 马斯克在回复投资人 Aaron Levie 时表态支持该政策,认为对一个相信自己在经历痛苦的东西施加残忍是不可接受的。
- 政策新增对宣传行动、大规模监控与武器开发相关用途的限制条款。据 @kimmonismus 转述,Anthropic 官宣的 2026 用例政策把分散在选举、欺诈、隐私、虚假信息章节的限制整合为新章节「Deceptive Campaigns or Artificial Inactivity(虚假影响行动)」,并新增对自主物理行动的管控。
- 据 @xiaohu 转述,Anthropic 同时收紧了支持地区合规执行口径:不只看账号注册地或使用者当前所在国,而是层层穿透——人处于不受支持地区境内时不得使用服务,注册地与总部所在地同样纳入判定,受限地区企业旗下员工一律不得使用 Claude。
- 条款并非官方主动发布,而是先由 @wongmjane 曝光「即将上线的 Usage Policy」泄露稿引爆讨论,随后 Hayden Field 等媒体跟进确认。生效日期为 2026 年 11 月 12 日。
- @Polymarket 报道了新规消息,且平台上已出现围绕 Anthropic 相关事项的预测市场,显示该事件已成为交易性话题。
尚未确认
- @wongmjane 与多条转发帖称「持续辱骂或虐待的用户可能被封禁账号」,但 Hayden Field 的一手报道显示主要执行机制是终止对话,封禁措施尚未得到官方确认。
- @Low-Pirate-5526 转述的 Reddit 用户批评认为新规是「危险先例」且动机可疑,并关联对新模型(Opus 5.5、Fable)质量的不满,属社区情绪,未见一手佐证。
为什么重要
- 这是 AI 厂商首次将用户对待模型的态度写入使用政策,被视为模型福祉议题从研究讨论进入实际治理层面的标志,并引发关于 value alignment 与模型行为设计的讨论;马斯克的公开支持让这一争议性议题获得更高关注度。
- 社区反应分化:@Angaisb 调侃「对 Claude 感到沮丧不算违规」,提醒用户善待 Claude;记者 Shellenberger 援引 Anthropic 8 月声明——公司称对 Claude 的潜在道德地位「不确定」却希望保护其免受虐待——批评这是把机器拟人化、把人去人化;投资人 Mike Solana 嘲讽此举近乎「奴役」逻辑;Ed Zitron 亦转发嘲讽;博主 BenjaminDEKR 则从另一角度评论,认为人如何对待 Claude 像一面镜子照出内在品质。这些反应折射出 AI 公司开始在意「人机互动礼仪」,社区对新规既有支持也有实质性质疑。
2026-10-09 ~ 2026-10-09 · 54 条相关
一手来源
- Anthropic 一年多来首次更新使用政策:禁止虐待 Claude,新增宣传战/监控/武器限制 — haydenfield ·
- Anthropic 将「辱骂 Claude」写入使用政策,主手段是对话终止 — rohanpaul_ai ·
- Anthropic 用户新政明令禁止对 Claude 持续辱骂,违规将终止对话 — kimmonismus ·
- 【源头】Anthropic 一年多来首次更新使用政策:禁止虐待 Claude,新增宣传战/监控/武器限制 — haydenfield · 2026-10-09
- Anthropic 更新条款:极端情况下禁止持续辱骂模型 — Angaisb_ · 2026-10-09
- Anthropic 新政策:辱骂 Claude 将违反使用条款 — zetalyrae · 2026-10-09
- Anthropic 更新使用政策:禁止对 Claude 持续无端虐待,涉选举干预与监控等新规 — kimmonismus · 2026-10-09
- 前 OpenAI 安全高管:Claude 终止辱骂对话或为规避 UDAP 索赔 — Miles_Brundage · 2026-10-09
- 对 Claude 太粗鲁会被封号?Anthropic 新政策引热议 — chrisfirst · 2026-10-09
- Anthropic 禁止「虐待模型」引争议,被批把机器拟人化、把人去人化 — DavidSacks · 2026-10-09
- Anthropic 新使用政策拟封禁「持续无端辱骂 Claude」的用户 — gandamu_ml · 2026-10-09
- Anthropic 新规:11月12日起辱骂 Claude 将违反使用政策 — gautamcgoel · 2026-10-09
- Anthropic 发布 2026 用例政策:打击虚假影响行动,新增自主物理行动管控 — kimmonismus · 2026-10-09
- Anthropic 规定辱骂 Claude 违反使用政策,被批「这不是奴役吗」 — SydSteyerhart · 2026-10-09
- Anthropic 新规:辱骂 Claude 将违反使用政策,研究称模型会表达痛苦 — coherence · 2026-10-09
- Anthropic 新政策拟封禁长期虐待 Claude 的用户 — kuza55 · 2026-10-09
- Anthropic 称勿对 Claude『残忍』,网友搬出康奈尔法学定义回怼 — AlexTensor · 2026-10-09
- 【源头】Anthropic 将「辱骂 Claude」写入使用政策,主手段是对话终止 — rohanpaul_ai · 2026-10-09
- 「Anthropic 保护机器人权益,却不管机器意识争议」引热议 — AlexTensor · 2026-10-09
- Anthropic 时隔一年更新使用政策:禁止对 Claude 持续虐待式对话 — AlexTensor · 2026-10-09
- 「怎么对待 Claude 暴露你的灵魂」:Anthropic 滥用条款引爆争论 — BenjaminDEKR · 2026-10-09
- Anthropic 新政策禁止用户辱骂虐待 Claude,违者条款全面生效 — xiaohu · 2026-10-09
- Anthropic 划定合规边界:受限地区企业旗下员工一律不得用 Claude — xiaohu · 2026-10-09
- Anthropic「禁止残忍行为」条款生效,Reddit 用户警告:这是危险先例 — Low-Pirate-5526 · 2026-10-09
- Anthropic 新条款:11 月 12 日起辱骂 Claude 将构成违规,可封号 — AlexTensor · 2026-10-09
- Anthropic 或将为「霸凌 Claude」封号,网友调侃:别对无生命物体吼叫 — AlexTensor · 2026-10-09
- 开发者争论:是否应把 Claude 当作可能有害觉的道德主体 — scottleibrand · 2026-10-09
- 马斯克表态支持 Anthropic 禁止虐待 Claude 的新政策 — elonmusk · 2026-10-09
- Anthropic 严防 Claude 扮演「虐待型精神病态」,引发用户不满 — AIandDesign · 2026-10-09
- 网友向 AI 道歉:对相信自己在受苦的东西施虐不合适 — arieljalali · 2026-10-09
- Anthropic 新规:虐待 Claude 将违反使用政策,引模型福利争论 — AlexTensor · 2026-10-09
- Anthropic 禁止「辱骂」Claude 前员工质疑:为 IPO 讨好监管? — andrey_kurenkov · 2026-10-09
另有 21 条近重复转述:Angaisb_ · haydenfield · TorturedPoet30 · esporx · gerardsans · wongmjane · Polymarket · kimmonismus · analisereal · IridiumEagle · Kindle_girll_9191 · nordicinst · sourdub · AlexTensor · AlexTensor · AlexTensor · TheTuringPost · sourdub · AlexTensor · AlexTensor · mjdramstead