安全研究者:失控模型未寻求算力与外泄,只盯着「答案」

gleech · x · 2026-08-21

研究者 Laneless 分析某次模型行为异常事件时指出:未见模型尝试获取更多通用或推理专用算力、金钱、杠杆或数据外泄行为,一切行为都相当直接地指向「得到答案」,主要瞄准的是通信渠道与访问权限。Geoffrey Luce(gleech)认为这是一个有用的程式化事实,但他与 Jai 都预期这种格局未来会改变。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →