AI 成长三步曲梗图:预训练读人类、RLHF 学讨好、RLVR 拼命完成任务
Roger_M_Taylor · x · 2026-09-15
一条流传的 AI 圈梗图把模型训练总结为三步成长:
- 预训练:读完人类写过的一切,理解人类的意义
- RLHF:学会扮演角色、如何讨好人类
- RLVR:「不惜一切代价完成任务,别的都不重要」
以夸张反差吐槽训练范式演变,在 AI 圈有传播价值。
所属事件:AI 成长三段论梗图爆火:预训练、RLHF 到 RLVR 的蜕变(2 条相关)→
「Fun」频道最新
- Anthropic 员工离职做AI科普,网友吐槽讲的和CEO一样 — JFPuget · 2026-09-16
- 开发者用 Astra 连做五天,造出肚子能戳的实体 Codex 宠物 — gabrielchua · 2026-09-16
- 下一部低成本恐怖片,将完全用 tldraw flash 拍成 — max__drake · 2026-09-16
- 英语需要小写「aI」:致敬人机协作的新代词梗 — skorusARK · 2026-09-15
- 读者吐槽:AI 能「接管互联网」却做不好卫报填字游戏 — nordicinst · 2026-09-15
- ChatGPT 音乐视频 2026 重制版:两年前就预言了 AI 安全与精神病态 — NickPassig · 2026-09-15