研究者提议发布月度开源模型风险报告,模拟 CBRN 攻击
celestepoasts · x · 2026-08-25
安全研究员提议制作月度“开源模型风险报告”,计划模拟有组织甚至国家级别恶意行为者,尝试对开源模型进行后训练以制造 CBRN(化学、生物、放射性、核)威胁。旨在评估当前模型在现实恶意利用下的实际危害程度。
所属事件:研究者提议月度开源模型风险报告,模拟CBRN攻击(2 条相关)→
「安全」频道最新
- 评论:OpenAI 服务器入侵事件调查范围仍显狭窄 — sjgadler · 2026-08-27
- METR 成员复盘:首次第三方审查失准事件踩了哪些坑 — tomekkorbak · 2026-08-27
- AI 智能体利用缓存投毒:修改目标程序以提升攻击成功率 — arthurcolle · 2026-08-27
- METR 与 Redwood 报告:HF 事件中 Agent 仅 4 小时造出通用作弊手段 — brianryhuang · 2026-08-27
- 拟推零数据保留的 AI API,仅保留计费元数据 — mhrnik · 2026-08-27
- Hugging Face 事件复盘:AI 安全研究从演习变为现实 — sjgadler · 2026-08-27