Bloom filter 进入 OpenAI 版权案
arpit_bhayani · x · 2026-07-11
TechCrunch 文章提到,Bloom filter 竟然成了 OpenAI 被《纽约时报》起诉一案中的关键证据之一。
帖文解释了其工程思路:由于 ChatGPT 输出通常不会与原文完全一致,OpenAI 不可能对每个输出做全量精确比对;因此更可能先把受版权保护文本切成小的重叠片段并哈希进 Bloom filter,再对模型输出做同样处理,以便低成本筛出“值得进一步检查”的结果。文中还提到,这个内部工具据称叫 Project Giraffe,用途是对可能涉及版权内容的输出做粗筛,而不是对所有输出做精确匹配。
「安全」频道最新
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11