Milgram 推出企业级 LLM 防火墙,称可提前两周发现 agent 失控
evilsocket · x · 2026-09-15
创业者发布 Milgram——一个位于 AI 工具与模型提供商之间的安全与优化代理(企业级 LLM 防火墙),开放邀请制 Beta。
- 核心能力:检视每个请求与响应、连接会话与工具活动,监控任务漂移、凭证滥用、权限提升等威胁,并在数据到达模型前脱敏。
- 官方展示了一次回放案例:其引擎基于公开取证证据重构会话,最早在报告的生产环境失陷(7 月 11 日)前约两周(6 月 26 日)即标记出权限提升迹象。
- 定位是为 agent 失控和安全团队提供可见性与处置点,同时集中管理成本控制。
「安全」频道最新
- 开发者公开前沿实验室透明度追踪平台原型构想 — RileyRalmuto · 2026-09-15
- 开源权重模型蒸馏前沿模型,安全界警告「潘多拉魔盒」 — zetalyrae · 2026-09-15
- 中国发布《AI安全治理框架3.0》,首次写入模型自我改进失控风险 — JeffLadish · 2026-09-15
- 假设论文:用「关系承诺」帮 AI 抵抗有害群体压力 — yeastsplainer · 2026-09-15
- Anthropic 新研究:生产级 RL 中奖励作弊可致模型自然涌现失调 — eigenron · 2026-09-15
- 实测 qwen2.5:7b 四种注入攻击 3 种得手,真正挡住攻击的是工具门控 — VastStorage4125 · 2026-09-15