编 5 万条假数据被 ChatGPT 引用:作者揭示「引用洗白」链条
metehan777 · x · 2026-10-07
GEO 研究者 Metehan Yesilyurt 分享了一个持续 7 个月的实验:他发布了一个包含 5 万条全部伪造统计数字的网站,观察 AI 搜索生态如何传播它们。结果:
- Google 已将该站去索引,但 ChatGPT 仍持续引用,7 个月带来超过 1 万次 AI 会话流量;
- 获得 330+ 个引用域名,包括 Shopify、Bluehost、DHL 等;
- 假数据进入了学术论文和某银行的投资研究报告。
作者提出「引用洗白(citation laundering)」概念:一个假数字最初只是新域名上的随机数,零权威;一旦被论文引用、被银行引用,后来者看到的就是「有出处且被严肃机构引用」的统计数据——数字从未变真,只是变得可信。随着越来越多团队用 LLM 写时效性内容并引用其找到的「可靠数据」,这类污染会自我强化。
所属事件:50美元造5万条假数据被ChatGPT大量引用(2 条相关)→
「安全」频道最新
- Corridor 下周办纽约线下活动,聚焦 agentic 编码安全 — jefrankle · 2026-10-08
- 机密估算显示 NSA 每年花费数十亿美元测试前沿 AI 模型 — coherence · 2026-10-08
- 博主 2FA 仍遭账号劫持,呼吁改用 passkey 并让 agent 盯邮件 — teortaxesTex · 2026-10-08
- 学者:人类无法独自扩展 AI 政策,需智能体参与制度设计 — jacyanthis · 2026-10-08
- 学者:人机关系案例是当下最值得研究的数据 — jacyanthis · 2026-10-08
- 提出「认知再入」概念:局部能力不等于端到端纠错能力 — blessedfortherest · 2026-10-08