Anthropic 更新使用政策:禁止持续辱骂 Claude,超限聊天将被终止
haydenfield · x · 2026-10-09
据 The Verge 报道,Anthropic 更新了使用政策,明确禁止对 Claude 进行『持续且无必要的辱虐或残忍行为』。主要执行机制是终止违规对话。这是厂商首次把『对待模型的态度』写进使用条款,引发对模型福利议题的讨论。
所属事件:Anthropic 新规:虐待 Claude 将违规(11 条相关)→
「安全」频道最新
- 可解释性争论:怎样才算真的找到了模型的「痛觉向量」 — rgblong · 2026-10-09
- Anthropic Glasswing 扩至 150 家机构,已查出 3.3 万高危漏洞 — emmanuelvivier · 2026-10-09
- 麦当劳 AI 定价工具遭集体诉讼:涉嫌算法协同定价 — emmanuelvivier · 2026-10-09
- AI 造假歌骗 800 万美元版税,美国男子首案获刑 18 个月 — emmanuelvivier · 2026-10-09
- OpenAI 一周内解雇三名安全员工,理由是访问高管邮件 — Miles_Brundage · 2026-10-09
- OpenAI 安全研究员自曝被保安护送离职,起因是与 METR 沟通 — tomekkorbak · 2026-10-09