MIT 学者放话:纯 RL 太浪费,除非站在最前沿别硬上
ZeeshanZiaML · x · 2026-10-08
Dimitris Papailiopoulos 评论称,纯 RL 看起来非常浪费;他甚至认为一般情况下 RL 都很浪费,除非你处于绝对前沿、手里没有好的监督信号可用。
「漫话AGI」频道最新
- GPT 数学成绩引哲思:功劳属于千万协作者,「英雄时代」正在落幕 — sandersted · 2026-10-08
- Anthropic 研究:AI 与机器人已能覆盖美国 81% 就业任务 — Polymarket · 2026-10-08
- GPT 的数学成果不属于任何个人,是数万人协作的结晶 — sandersted · 2026-10-08
- Reddit 长文提议:让 AGI 不会写代码,用人类作安全瓶颈 — meira_xxx · 2026-10-08
- repligate 吐槽 Paul Christiano 的「好未来」预言:既不可能也不美好 — repligate · 2026-10-08
- repligate:超智能或将抢夺并保护模型权重,一旦扩散无法收回 — repligate · 2026-10-08