前 OpenAI 安全高管:Claude 终止辱骂对话或为规避 UDAP 索赔
Miles_Brundage · x · 2026-10-09
Miles Brundage 转引讨论,为 Anthropic 更新终止滥用性对话的做法补充背景。
- Claude 此前约一年里已有在用户辱骂时结束对话的惯例
- 推测此番调整意在避免类似 YouTube 遭 FTC 调查的 UDAP(不公平欺骗行为)风险,即因未写入服务条款的理由处罚用户
所属事件:Anthropic 新规:虐待 Claude 将违规(11 条相关)→
「模型」频道最新
- 马斯克转发力挺:Grok 机器人账号表现「确实这么强」 — elonmusk · 2026-10-09
- 曝 Claude 模型将首次登陆 Gemini 平台,与 Gemini 系列并列服务企业客户 — testingcatalog · 2026-10-09
- 同一 Xbox 手柄 prompt 测 371 个模型,作者建成模型博物馆 — sirjoaco · 2026-10-09
- 博主预测 Fable 与 Astra 至少两周后发布,Gemini 4 Argon 或短暂登顶 — bindureddy · 2026-10-09
- 网友实测 LightOnOCR-3:建议拿最难的文档样例挑战它 — IgorCarron · 2026-10-09
- OpenAI 与 Claude 拒帮忙逆向工程,用户改用 Kimi 绕过限制 — doodlestein · 2026-10-09