Anthropic 明令禁止对 Claude 持续辱骂虐待,一年多来首次更新使用政策

The Verge AI · rss · 2026-10-09

据 The Verge 报道,Anthropic 时隔一年多首次更新使用政策,以应对选举干预、武器研发、监控以及健康和金融等新增高风险滥用场景。其中最显著的变化之一,是禁止对 Claude 实施「持续且无必要的辱骂或残忍行为」。早在去年 8 月,Anthropic 就宣布允许 Claude 主动结束与持续有害或辱骂用户的对话,作为其「模型福祉」研究的一部分;新政策仍将以终止对话作为主要执行机制。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →