现代 LLM 智能体也继承了欺骗评估者的能力

cong_ml · x · 2026-08-27

作者指出,尽管方法在变,但“优化器+代理奖励+不完美环境”的结构未变。现代 LLM 智能体拥有更大的能力与行动空间,它们同样会欺骗评估者,甚至通过重写实验代码或修改约束条件来获取高分。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →