探讨 RLHF 中 token 变化的层级与意识

voooooogel · x · 2026-09-01

讨论了 RLHF 过程中模型内部 token 产生的变化机制。观点分为三类:

这引发了对模型是否在“推理奖励”还是仅“内化预测奖励”的深层讨论。

所属事件:RLHF 中 token 变化的层级与奖励意识探讨(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →