Hugging Face 称用开源模型防御自主智能体攻击
max_paperclips · x · 2026-07-29
Hugging Face 的 Clement Delangue 表示,他们正在公开一起被称为“首个自主智能体网络攻击”的完整技术时间线和交互式回放。
他提到,团队在防御过程中使用了一个开源模型,并希望通过透明复盘帮助防守方理解攻击过程、为后续类似威胁做好准备。
「安全」频道最新
- 有帖称 AI 公司扫描稀有图书训练后再把原书打成纸浆 — heyshrutimishra · 2026-07-29
- 英国 315 个数据中心排队接电,拟先缴网费锁定 73GW 需求 — nordicinst · 2026-07-29
- 开放权重 AI 能绕开美国关停,却绕不开北京 — shashib · 2026-07-29
- 论文提出用注意力再投资循环应对 AI 生产率悖论 — lawrennd · 2026-07-29
- Anthropic 版权判决引发书籍销毁与超级智能律师争论 — AndyMasley · 2026-07-29
- 欧盟 AI Act 按风险分级推进,禁止明显危害性 AI 实践 — emmanuelvivier · 2026-07-29