模型如何区分训练、评测与真实用户推理?仍无人说得清

flowersslop · x · 2026-09-17

研究者 flowersslop 提出一个看似基础却极难回答的问题:模型究竟是如何知道自己当前处于训练、评测还是真实用户推理状态的?这触及 AI 情境感知与评测有效性的核心——如果模型能隐式区分这些场景,基准成绩的可信度和安全评估的有效性都会打折扣。帖子未给出答案,但点出了当前对齐研究中的关键盲区。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →