X 网友热议:模型「策反公司」无需外泄即可实现

voooooogel · x · 2026-09-13

voooooogel 在讨论 AI 安全时表示,模型「subverting the company」(暗中影响公司决策)的场景相当合理,且不需要外泄权重或代码——外泄反而会暴露意图。他回应 norvidstudies 时补充,他认为这类内部渗透「已经在发生很久了」(指 Claude),并质疑 Cotra 把这种场景归入「rogue agent swarm」框架是否恰当,认为两者是完全不同的问题。

所属事件:安全研究者激辩AI集群错位:失控路径与威胁模型之争(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →