用人类审查每个 RL rollout 消灭对齐风险?这玩笑有点损
himanshustwts · x · 2026-09-05
vikhyatk 提出一个半开玩笑的提案:RL 训练中产生的每个 rollout 都必须先经人类审查再回传梯度。这样能基本消除对齐风险,顺便还能给人类创造数十亿个审查岗位。
本质上是在调侃当下对齐问题与 RL 训练自动化规模之间的矛盾——审查成本高到荒谬,反而成了就业计划。
「Fun」频道最新
- Reddit 玩梗:"AGI 已经实现了" — SureSpecial1834 · 2026-09-05
- 让 Fable 自己拍视频谈谈 AI 与"奇点" — Juulk9087 · 2026-09-05
- AI 绘画之争升级:反方称 99% AI 画师拿不起铅笔,正方驳“护城河论” — taherdhanera · 2026-09-05
- 大批大号同时吹捧 Zcash,被质疑是一场协调带货行动 — abhishekcode42 · 2026-09-05
- 真人遥控高达机器人实机演示视频曝光 — i_bioloid · 2026-09-05
- 用户吐槽:谷歌正式让Gemini变烂了 — Outreia · 2026-09-05