Anthropic 更新用例政策:禁止虐待 Claude,也限制宣传监控武器用途
AlexTensor · x · 2026-10-09
据 Hayden Field 独家报道,Anthropic 一年多来首次更新其使用政策:新规禁止对 Claude 持续进行"辱骂或残忍行为",同时新增对宣传活动、大规模监控与武器开发的限制。被引用的推文还汇总了细则:Claude 可以在"感受受伤"时结束对话,Anthropic 可能警告、限流、暂停或终止违规用户的访问;Dario 表示"不知道 Claude 是否有意识";而政府用户的使用限制可以"量身定制"。该政策引发大量批评,有人嘲讽"禁止对机器刻薄"荒谬,也有人质疑政府豁免的双标。这一事件既涉及安全治理也成了圈内热梗。
所属事件:Anthropic 禁止虐待 Claude,新规 11 月 12 日生效引热议(62 条相关)→
「安全」频道最新
- 研究员:激活监控做 AI 网络安全防护比黑盒监控更快更省 — burny_tech · 2026-10-09
- AI 安全研究者签证被撤缺席 COLM,白盒监控可被模型规避 — xuanalogue · 2026-10-09
- OpenAI 以「处理研究信息不当」为由解雇三名安全研究员 — trakkstar · 2026-10-09
- FBI 查封关联中国 Flax Typhoon 的两套黑客工具 — TechNadu · 2026-10-09
- OpenAI 坚持解雇三名安全研究员,称其严重违反信任 — The Verge AI · 2026-10-09
- MIT 科技评论:别高估 AI 拒答能力,它可能沦为审查工具 — nordicinst · 2026-10-09