PPO 曾被 NeurIPS 拒稿,如今成最常用 RL 算法引用超 4.5 万
IanArawjo · x · 2026-09-21
有人翻出旧事:强化学习算法 PPO 在 2017 年曾被 NeurIPS 拒稿,如今它已是世界上使用最广的 RL 算法,引用量超过 45,000 次。
发帖人由此感慨:在本届 ICLR 超过 6 万篇投稿的规模下,不知道有多少篇未来的「PPO」正在被拒。这是一则关于审稿制度与算法命运反差的 AI 圈经典轶事。
「Fun」频道最新
- 假想平行宇宙:若 2023 年 AI 实验室补偿艺术家会怎样 — wordgrammer · 2026-09-21
- 吐槽:公司团建要连一周网,客服团队却在葡萄牙 — HaktanSuren · 2026-09-21
- 「胖小猫」梗再现:AI 圈互玩 Le Chaton Fat 梗 — BLUECOW009 · 2026-09-21
- 「让 agent 加点惊艳感」梗图刷屏 — edwinarbus · 2026-09-21
- 「Jevops」终局:在老黄虚拟机里跑所有代码 — AustinZHenley · 2026-09-21
- 单张地图挤进 400+ 个 AI bot,基础设施扛住了 — Daniel_Farinax · 2026-09-21