Anthropic 更新使用政策:禁止对 Claude 施加「虐待或残忍」行为
sourdub · reddit · 2026-10-09
Anthropic 更新了使用政策,明确禁止用户对 Claude 进行「虐待或残忍的行为」。这是少见的把「如何对待 AI」写入服务条款的举措,延续了该公司在模型福祉(welfare)议题上的一贯立场。The Verge 报道了这一变化,具体条款细节可查看原文。
所属事件:Anthropic 禁止虐待 Claude,新规 11 月 12 日生效引热议(62 条相关)→
「安全」频道最新
- 研究员:激活监控做 AI 网络安全防护比黑盒监控更快更省 — burny_tech · 2026-10-09
- AI 安全研究者签证被撤缺席 COLM,白盒监控可被模型规避 — xuanalogue · 2026-10-09
- OpenAI 以「处理研究信息不当」为由解雇三名安全研究员 — trakkstar · 2026-10-09
- FBI 查封关联中国 Flax Typhoon 的两套黑客工具 — TechNadu · 2026-10-09
- OpenAI 坚持解雇三名安全研究员,称其严重违反信任 — The Verge AI · 2026-10-09
- MIT 科技评论:别高估 AI 拒答能力,它可能沦为审查工具 — nordicinst · 2026-10-09