Anthropic 发布 2026 用例政策:打击虚假影响行动,新增自主物理行动管控
kimmonismus · x · 2026-10-09
Anthropic 官宣 2026 用例政策更新,11 月 12 日生效。要点:1) 把分散在选举、欺诈、隐私、虚假信息章节的限制整合为新章节「Do Not Engage in Deceptive Campaigns or Artificial Activity」,覆盖国家媒体、政府宣传机构和商业公司用 Claude 运营假账号网络和捏造新闻站的影响行动;2) 依据最新威胁情报报告,补充针对影响行动、武器开发、监控滥用的新模式;3) 明确健康、金融等高风险用途要求;4) 新增 Claude 自主采取物理行动时的管控;5) 针对对模型持续辱骂行为新增条款;6) 更新反映 Claude 更长程自主工作能力的新示例。
所属事件:Anthropic 新规:持续辱虐 Claude 将违规,引发拟人化争议(21 条相关)→
「安全」频道最新
- ChatGPT 编造判例致律师被停职,视频复盘 AI 幻觉司法翻车 — dadakoglu · 2026-10-09
- 用户撤销权限后 Codex 仍可读写旧文件夹,且官方无法解释 — Some-Following-392 · 2026-10-09
- 美国众议院 AI 伤害草案:模型公司担责,除非 agent 开发者有疏忽 — serendip-ml · 2026-10-09
- Anthropic 推 OSS Scanner:免费为开源项目做 AI 安全扫描 — The Verge AI · 2026-10-09
- Veracode 报告:AI 写近半代码,安全通过率仅 56% — WeldPond · 2026-10-09
- Phrack 第 73 期刊发漏洞研究传奇 Halvar Flake 深度人物专访 — WeldPond · 2026-10-09