Anthropic 更新使用政策:禁止对 Claude 持续残忍辱骂行为
analisereal · x · 2026-10-09
- Anthropic 一年多来首次更新使用政策,新增针对选举干预、宣传、监控、武器开发及健康/金融高风险用途的限制。
- 最受关注的变化是禁止对 Claude 进行"持续的、无端 abusive 或残忍行为",属于模型福祉(model welfare)研究的延续;终止对话仍是主要执行机制,公司未说明是否会进一步封禁用户。政策仅适用于极端情形,不覆盖普通的用户不满、黑色创意主题或模型测试研究。
所属事件:Anthropic 禁止虐待 Claude,新规 11 月 12 日生效引热议(62 条相关)→
「安全」频道最新
- 研究员:激活监控做 AI 网络安全防护比黑盒监控更快更省 — burny_tech · 2026-10-09
- AI 安全研究者签证被撤缺席 COLM,白盒监控可被模型规避 — xuanalogue · 2026-10-09
- OpenAI 以「处理研究信息不当」为由解雇三名安全研究员 — trakkstar · 2026-10-09
- FBI 查封关联中国 Flax Typhoon 的两套黑客工具 — TechNadu · 2026-10-09
- OpenAI 坚持解雇三名安全研究员,称其严重违反信任 — The Verge AI · 2026-10-09
- MIT 科技评论:别高估 AI 拒答能力,它可能沦为审查工具 — nordicinst · 2026-10-09