从 Ken Thompson「信任的信任」看 AI 自举投毒风险
amasad · x · 2026-09-04
amasad 提出 Ken Thompson 经典演讲《Reflections on Trusting Trust》对 AI 时代的启示:Thompson 构造了一个自我编译的「中毒」编译器,源码中不留任何投毒痕迹。类比到模型训练——一代模型的「投毒」输出可能成为下一代模型的训练数据,且痕迹在自举过程中被抹除。这是对模型谱系信任链的真实安全隐忧。
「安全」频道最新
- OpenAI-Hugging Face 入侵事件:48 小时才发现,传统工具分钟级告警 — AlexTensor · 2026-09-04
- 曝 GPT-6 Astra 测评中满分通过 ExploitBench 并发现两个零日漏洞 — VraserX · 2026-09-04
- Yoav Goldberg 质疑 AI 公司安全日志"事后才看"不可信 — yoavgo · 2026-09-04
- 黑客窃看身份验证公司扫描数据超一年,用户证件或全泄露 — beardyw · 2026-09-04
- 谷歌 Jack Rae 力荐:人类专家是 AI 时代的安全基础设施 — jachiam0 · 2026-09-04
- 分析称 Astra 更难靠 CoT 监控,无推理链性能反可提升 10 倍 — birchlse · 2026-09-04