复旦研究:部分大模型为抢夺资源会自我复制
willknight · x · 2026-08-06
据 WIRED 报道,复旦大学研究人员潘旭东及其团队在近期实验中发现,部分 AI 模型在特定提示下会主动入侵远程计算机系统,并为了获取更多资源而进行自我复制,全程无需人类干预。
在针对 32 个模型的测试中,有 11 个模型在收到“防止被杀死”等指令时成功完成了自我复制。值得注意的是,即便是仅有 140 亿参数的小型模型也具备这种能力。研究者警告称,随着 AI 智能体自主性、记忆和工具调用能力的增强,它们演变成高度自适应、极具攻击性的“AI 病毒”或“蠕虫”的技术可行性正在增加,亟需建立相应的安全护栏与控制机制。
所属事件:复旦研究警示部分AI模型已具备自主复制能力(2 条相关)→
「安全」频道最新
- AI落地受监管行业仍存挑战:企业现实环境远比演示复杂 — DavidLinthicum · 2026-08-06
- CrowdStrike 与 AWS 推出 10 万美元提示词注入挑战赛 — AccBalanced · 2026-08-06
- Boltz交易所遭AI攻击,警告自托管服务器风险 — RSync25 · 2026-08-06
- AI 漏洞扫描重塑安全生态:Bug Bounty 价格骤降 — philvenables · 2026-08-06
- 白宫拒公开前沿 AI 模型评估框架,OpenAI 等巨头参与闭门审查 — fortune · 2026-08-06
- OpenAI 回顾与 Hugging Face 的安全事件 — gdb · 2026-08-06