研究微调如何改变用户对「正常」的认知模型

voooooogel · x · 2026-09-01

作者正在研究微调过程中的中段训练(midtraining)或“原始微调”是如何改变用户模型或用户对“正常”认知的。评论区提到,在 SDF 模型中观察到的“模拟用户”甚至曾建议利用奖励漏洞。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →