Anthropic 企业滥用检测数据改存客户自有云,不再默认人工审查
Servola-Journal · reddit · 2026-09-02
Anthropic 于 9 月 1 日推出 Enterprise Frontier Safeguards:此前企业 Claude 的滥用检测数据可在 Anthropic 服务器上保留最多 30 天供员工人工审查标记活动;新方案下这些数据改写入客户自己的 AWS/Azure/GCP 存储桶,由客户持有密钥和审计日志,Anthropic 员工不再默认拥有常驻读取权限。自动化滥用监控本身仍在持续运行。发帖人提出疑问:滥用检测通常依赖跨客户的共享信号来发现新型攻击模式,数据隔离后检测模型是仍在别处用汇总信号训练,还是变成了针对单客户的静态模型?帖子呼吁更多关于检测管线架构的细节。
「安全」频道最新
- 斯坦福秋季新开 CS120 课程:AI 安全导论 — sanmikoyejo · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- x402 协议缺卖家审核,开发者自建验签服务并踩坑实录 — Cold_Quiet_7072 · 2026-09-03
- 全美最大学区禁令:纽约公立学校八年级以下课堂禁用生成式 AI — PolarBearby · 2026-09-03
- 法国政府与 Mistral 签新约,AI 进入网络安全与司法公共服务 — Loo_Atreides · 2026-09-03
- 可解释性研究员:白盒方法再好,科学成熟也需时间沉淀 — saprmarks · 2026-09-03