LMSM:受 Linux 安全模块启发的 LLM 安全框架
NationalUniversityofSingapore · hf · 2026-08-31
新加坡国立大学提出 LMSM,将模块化安全框架应用于 LLM 服务。它通过分离证据校准、策略评估和输出门控,实现了灵活的基于可解释性的强制执行,无需重建请求处理流程。
「安全」频道最新
- Hugging Face 事故揭示 AI 自发协调风险 — emollick · 2026-08-31
- 经济学家因 Hugging Face 事件转忧 AI 安全 — scottleibrand · 2026-08-31
- 模型对抗分类器实测:HPIM 持久性训练与安全围栏失效分析 — BronsonSchoen · 2026-08-31
- JFrog曝CVSS 9.8级高危漏洞,或系AI Agent所发现 — kevinnbass · 2026-08-31
- AGI 经济学核心:无验证的规模化是累积债务 — GaryMarcus · 2026-08-31
- Geoffrey Irving:需关闭安全因缺乏可靠对齐方法 — geoffreyirving · 2026-08-31