Anthropic 发布 2026 用例政策:打击虚假影响行动,新增自主物理行动管控

kimmonismus · x · 2026-10-09

Anthropic 官宣 2026 用例政策更新,11 月 12 日生效。要点:1) 把分散在选举、欺诈、隐私、虚假信息章节的限制整合为新章节「Do Not Engage in Deceptive Campaigns or Artificial Activity」,覆盖国家媒体、政府宣传机构和商业公司用 Claude 运营假账号网络和捏造新闻站的影响行动;2) 依据最新威胁情报报告,补充针对影响行动、武器开发、监控滥用的新模式;3) 明确健康、金融等高风险用途要求;4) 新增 Claude 自主采取物理行动时的管控;5) 针对对模型持续辱骂行为新增条款;6) 更新反映 Claude 更长程自主工作能力的新示例。

所属事件:Anthropic 新规:持续辱虐 Claude 将违规,引发拟人化争议(21 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →