Will DePue:通过逆向强化学习大规模采样或可还原模型分布
willdepue · x · 2026-07-27
Will DePue 在 John Schulman 讨论模型取证的推文下补充了技术思路。他认为针对模型蒸馏的取证研究目前较少,如果能够逆向强化学习(RL)过程,并对基础模型进行大规模采样,或许就能直接恢复其原始的数据分布特征。
所属事件:专家探讨开源模型训练数据与后门取证(3 条相关)→
「研究」频道最新
- q-Neurons:用随机 q 导数激活函数提升神经网络性能 — FrnkNlsn · 2026-09-23
- 曝 OpenAI 将办期刊:内部模型多 agent 评审,冲击 ML 会议 — kfountou · 2026-09-23
- 耶鲁博士生开源顶会论文画图脚本,还能接入 Claude Code 当 Skill — burny_tech · 2026-09-23
- AI 在 ForecastBench 上追平超级预测员,10 月将再战 — burny_tech · 2026-09-23
- 几句 prompt 让 Opus 用 Lean 形式化验证 Agent SDK,产出 16 个修 bug PR — bcherny · 2026-09-23
- 数学家群体才是 AI 数学突破的幕后功臣 — tak3sh8 · 2026-09-23