Anthropic 更新条款:极端情况下禁止持续辱骂模型
Angaisb_ · x · 2026-10-09
Anthropic 在其政策中新增规定,极端情况下会禁止对模型的持续辱骂行为。
作者调侃称「对 Claude 感到沮丧不算」,并提醒大家要善待 Claude。这可能与模型福祉(value alignment/模型行为设计)的讨论有关。
所属事件:Anthropic 更新使用政策:禁止虐待 Claude(7 条相关)→
「模型」频道最新
- Gemini 4 Argon 现身 Google 自家模型选择器,发布会在即 — vedantmisra · 2026-10-09
- ChatGPT 桌面版自封 CSV 默认打开方式遭用户吐槽 — generativist · 2026-10-09
- LightOnOCR-3 训练数据详解:MinHash 去重加公式表格加权采样 — IgorCarron · 2026-10-09
- LightOnOCR-3 用多目标 RLVR 同步优化文档定位、OCR 与空页处理 — IgorCarron · 2026-10-09
- 文档 grounding 训练难在标注:LightOn 用多 OCR+布局检测器建管线 — IgorCarron · 2026-10-09
- 不用 HTML 输出坐标:紧凑标记让 grounding 少耗 9–14% token — IgorCarron · 2026-10-09