Anthropic 更新使用政策:禁止对 Claude 持续无端虐待,涉选举干预与监控等新规
kimmonismus · x · 2026-10-09
据 The Verge 报道,Anthropic 一年多来首次更新使用政策,禁止用户对 Claude 进行「持续且无端的虐待或残忍行为」,延续其「模型福祉」研究方向。终止对话仍是主要执行机制,公司未说明是否会进一步封禁用户;新规仅适用于极端情况,不影响常见的不满、反驳、黑暗创意题材或模型测试研究。
政策同时将分散的限制整合为新的欺骗性内容禁令,并新增针对选举干扰/宣传攻势、监控、武器研发及健康与金融用途的规则。
所属事件:Anthropic 新规:虐待 Claude 将违规(11 条相关)→
「安全」频道最新
- Anthropic Glasswing 扩至 150 家机构,已查出 3.3 万高危漏洞 — emmanuelvivier · 2026-10-09
- 麦当劳 AI 定价工具遭集体诉讼:涉嫌算法协同定价 — emmanuelvivier · 2026-10-09
- AI 造假歌骗 800 万美元版税,美国男子首案获刑 18 个月 — emmanuelvivier · 2026-10-09
- OpenAI 一周内解雇三名安全员工,理由是访问高管邮件 — Miles_Brundage · 2026-10-09
- OpenAI 安全研究员自曝被保安护送离职,起因是与 METR 沟通 — tomekkorbak · 2026-10-09
- Anthropic 更新使用政策:明确禁止滥用 Claude 与干预选举 — TechCrunch AI · 2026-10-09