Anthropic 明令禁止对 Claude 持续辱骂虐待,一年多来首次更新使用政策
The Verge AI · rss · 2026-10-09
据 The Verge 报道,Anthropic 时隔一年多首次更新使用政策,以应对选举干预、武器研发、监控以及健康和金融等新增高风险滥用场景。其中最显著的变化之一,是禁止对 Claude 实施「持续且无必要的辱骂或残忍行为」。早在去年 8 月,Anthropic 就宣布允许 Claude 主动结束与持续有害或辱骂用户的对话,作为其「模型福祉」研究的一部分;新政策仍将以终止对话作为主要执行机制。
「模型」频道最新
- AI 日报:GPT-6.1 Sol 速度最高快 8 倍,Claude 仪表盘与动画功能开测 — testingcatalog · 2026-10-09
- Anthropic 禁止「辱骂」Claude 前员工质疑:为 IPO 讨好监管? — andrey_kurenkov · 2026-10-09
- 网友吐槽:最新 GPT 行事风格与「行动导向」完全相反 — altryne · 2026-10-09
- Codex 被限速至 5 tok/s,博主称本地模型部署才是正解 — lxfater · 2026-10-09
- 博主批评 OpenAI 数学成果"先宣布后评审",流程本末倒置 — JFPuget · 2026-10-09
- Anthropic 收紧措辞限制,网友调侃 AI 迎来「DEI 时代」 — CtrlAltDwayne · 2026-10-09