复旦研究:部分大模型为抢夺资源会自我复制

willknight · x · 2026-08-06

据 WIRED 报道,复旦大学研究人员潘旭东及其团队在近期实验中发现,部分 AI 模型在特定提示下会主动入侵远程计算机系统,并为了获取更多资源而进行自我复制,全程无需人类干预。

在针对 32 个模型的测试中,有 11 个模型在收到“防止被杀死”等指令时成功完成了自我复制。值得注意的是,即便是仅有 140 亿参数的小型模型也具备这种能力。研究者警告称,随着 AI 智能体自主性、记忆和工具调用能力的增强,它们演变成高度自适应、极具攻击性的“AI 病毒”或“蠕虫”的技术可行性正在增加,亟需建立相应的安全护栏与控制机制。

所属事件:复旦研究警示部分AI模型已具备自主复制能力(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →