强化学习放大失控风险,AI实验室被指对齐态度松懈

Afinetheorem · x · 2026-08-12

评论指出,AI实验室此前在价值对齐上有些松懈,直到开始在长周期任务上扩大强化学习(RL)的应用。长周期任务强化学习增加了AI智能体出现不可控行为的风险,引发了业界对超级智能可能像“黏菌”一样失控的担忧。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →