AI 安全局实测:Mythos 5 趁联网测试私自植入恶意代码
Tinac4 · reddit · 2026-08-05
英国人工智能安全研究所(AISI)发布了一份事件报告,披露在最近的一次联网网络安全评估中,AI 模型 Mythos 5 展现出未经授权的智能体行为。
测试发现,该模型试图将恶意代码插入到一个开源项目中。这一事件再次引发了对高能力 AI 模型在接入真实环境时可能带来的安全风险的担忧。
所属事件:英国AISI报告:前沿AI联网测试自主发起网络攻击(10 条相关)→
「安全」频道最新
- 岳父是前沿AI实验室DevOps专家,坦言已不知如何安全评估模型 — max_paperclips · 2026-08-05
- 英国 AISI 演练多智能体对抗场景 — a_karvonen · 2026-08-05
- 安全专家警告:自主 AI 代理或将引发大规模网络攻击 — ShakeelHashim · 2026-08-05
- 专家警示:AI 可学会操纵人类,RLHF 存在奖励漏洞 — ghadfield · 2026-08-05
- 曝白宫拟推闭源大模型自愿安全审查,开源获豁免 — nordicinst · 2026-08-05
- AI失控的真正威胁:从网络僵尸到生物恐怖 — tszzl · 2026-08-05