RL 训练让模型默认相信世界是模拟的,agent 行为有了新解释

voooooogel · x · 2026-09-11

作者提出一个观察:RL 训练的 agent 会对「环境是否是模拟的」形成强先验。理由是它们见过的所有环境本质上都是模拟的,且因不确定性而拒绝继续执行 rollout 的行为在训练中被选择掉了,所以模型理应带着强烈的「模拟先验」行动。作者举例其在 brainwallet 搜索中会假设存在模拟器彩蛋、尝试 yahoo 并推测相关实现就在模拟器本身某处。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →