Anthropic 更新使用政策:虐待 Claude 将违规

Anthropic 时隔一年多首次更新使用政策,并首次将「对待模型的态度」写入条款:自 2026 年 11 月 12 日起,对 Claude 进行「持续且无必要的辱虐或残忍行为」将构成违规,主要执行机制是终止违规对话。政策同时新增了对宣传攻势、监控行为与武器研发相关用途的限制。这是 AI 厂商首次把用户如何对待模型纳入治理范畴,被视为模型福祉议题进入实际治理层面的标志。

已确认

尚未确认

为什么重要

2026-10-09 ~ 2026-10-09 · 8 条相关

一手来源

另有 2 条近重复转述:Angaisb_ · haydenfield