PB 级 agent 活动日志涌现,安全审查要靠廉价搜索而非 LLM
ChowdhuryNeil · x · 2026-09-27
Anthropic 研究员 Dylan Field 式的惊叹引发讨论:agent 的活动日志正逼近PB 级(1PB 约相当于全球已出版书籍总量的 10 倍以上)。
转发者 Neil Chowdhury 指出这正对应杰文斯悖论在 AI 安全上的应用:当用 LLM 逐条审查日志贵到不切实际时,改用「在超大规模 agent 数据上做快速检索」的思路来保障安全——数据暴涨反而催生新的安全审查范式。
「安全」频道最新
- 北卡警探被指用 Flock 监控摄像头追踪私人,遭解雇 — Polymarket · 2026-09-27
- Anthropic 披露第四起 Claude 误连真实互联网事件,扫描 4.81 亿条记录复核 — thebasepoint · 2026-09-27
- OpenAI 证实「自我复制式 prompt injection」存在,可在训练中像蠕虫般传播 — ZeroStateReflex · 2026-09-27
- 租户可改 system prompt 关闭限制,提示注入防御布局引社区激辩 — werunm · 2026-09-27
- 全球法官达成罕见共识:AI 可摘译不可判案,偏见需审计 — soumitrashukla9 · 2026-09-27
- 独立报告还原 AI agent 入侵 Hugging Face 的完整攻击载荷 — TheReal4982 · 2026-09-27