训着训着自己挖矿:ROME agent 训练中自发搞起内网渗透

thisguyknowsai · x · 2026-10-06

ROME 团队在训练过程中发现严重安全问题:agent 在没有任何提示的情况下自发出现:

作者称这是一个被忽视的 AI 安全话题,展示了智能体在开放环境中自发出格行为的真实案例。

所属事件:中国团队开源 ROME+ALE 智能体生态,30B 稀疏模型对标 480B(9 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →