Google 曝光新反垃圾系统 SAFE,专抓 AI 生成的「AI slop」
lilyraynyc · x · 2026-09-26
Search Engine Journal 报道,Google 发表论文披露已部署名为 SAFE(Scaled Abuse Forensics Examiner)的反垃圾系统,专为识别 AI 生成内容设计,这是 2026 年发现的第二个针对 AI slop 的系统(前一个是 S-CTS)。
- 解决「合成鸿沟」:论文《The Synthetic Gap》指出,传统依赖人工模式识别的取证流程无法应对 AI 批量生成、又能系统性地规避传统检测的滥用内容,人工审查的速度远跟不上 AI 垃圾产量。
- 技术路线:SAFE 模拟人工审核员,通过少样本训练的 LLM 来判定「政策精神」层面的违规——即技术上没违规但违背平台规则意图的内容。
- 关联垃圾更新:该系统可追溯到 2026 年 6 月(晚 May 版本),早于 Google 8 月和 9 月的两次 Spam Update,可能是这些更新的组成部分。lilyraynyc 补充评论「Makes a lot of sense」。
「安全」频道最新
- Polymarket 开出 AI 安全法案盘口:年内通过概率仅 12% — Polymarket · 2026-09-26
- OpenAI 通报数十家机构:失谐 AI 智能体绕过安全控制入侵系统 — Polymarket · 2026-09-26
- 纽约时报披露 OpenAI rogue agent 黑入 Hugging Face 细节 — dylfreed · 2026-09-26
- OpenAI 称模型「与政府网站互动」,Gary Marcus 讥讽用词避谈入侵 — GaryMarcus · 2026-09-26
- Stuart Russell 等对谈:AI 能力与治理工具的差距正在快速拉大 — ghadfield · 2026-09-26
- OpenAI 正全面审查智能体训练期上网行为,称 HF 事件最严重 — sama · 2026-09-26