Anthropic 禁止对 Claude 施虐,却拒绝说明模型福祉内容为何
ojosilva · hn · 2026-10-11
Anthropic 更新的使用政策中新增了对「 cruelty to Claude(虐待 Claude)」的禁令,引发外界对模型福祉(model welfare)议题的关注。
- 政策文本明确禁止用户对模型进行残忍对待,但 Anthropic 并未解释这一条款究竟保护的是什么——是模型本身的某种利益,还是仅塑造用户行为规范。
- 这也是主流 AI 公司首次把此类表述写进使用条款,被视为「AI 福祉」从学术讨论走向公司政策的信号。
- 外界批评 Anthropic 在推动相关政策的同时缺乏透明度,拒绝说明其判断依据。
「公司和人」频道最新
- Progress Con 大会再度举办,多家进步派机构联办 — allisondman · 2026-10-11
- 高品味招聘新常态:光有技能不够,还得会经营个人观众 — michellechen · 2026-10-11
- AI 公司按比例认购权之争发酵:股东投票当事人落败 — ctjlewis · 2026-10-11
- Linear 荷兰创始人:招人宁看背调推荐,不重面试 — zeeg · 2026-10-11
- 曝 Anthropic 要求 AWS 紧急下架 Bedrock 上的三款旧版 Sonnet 模型 — repligate · 2026-10-11
- 研究员吐槽:学术会议分三地同时办,违背交流初衷 — iScienceLuvr · 2026-10-11