重审「信任的信任」:论文警告自修改 AI 编码面临投毒攻击
sbulaev · hn · 2026-09-18
一篇 arXiv 论文将 Ken Thompson 经典的《Reflections on Trusting Trust》问题引入 AI 编码时代:随着 AI 编码工具开始自我修改和生成代码,攻击者可能通过污染训练数据或生成过程实施「投毒」,让恶意代码在自我修改循环中隐蔽传播。论文讨论了这类攻击向量与对 AI 编码信任链的威胁。
「安全」频道最新
- 监控技术遭反弹,Flock Safety 提供买断计划收缩团队 — Polymarket · 2026-09-21
- 开发者警惕:前沿API定价与可用性已成地缘变量 — ccerrato147 · 2026-09-21
- Emad Mostaque:前沿模型权重正变成国家安全资产 — ccerrato147 · 2026-09-21
- 称Anthropic拒向英国AI安全研究所开放Mythos预发布访问 — ccerrato147 · 2026-09-21
- Anthropic 拒绝英国 AI 安全研究所预发布访问 Mythos 5.1,系首次 — ccerrato147 · 2026-09-21
- 假教程让 224 个钱包自建自投损失 51.7 万美元 ETH — 4KTV · 2026-09-21