RL 能否发现真正的新知识?边界没那么清晰
AndrewLampinen · x · 2026-10-03
Google DeepMind 研究员 Andrew Lampinen 在讨论强化学习能否发现真正新东西时指出:RL 确实可以发现全新的事物,但"新"与"旧"的边界并不总是清晰——比如把数学中两个领域首次联系起来,这算新发现,还是算"旧知识"(因为这两个领域都已出现在训练数据中)?他还补充,即使人类数学家发明新东西,通常也在相关领域有深厚积累。
所属事件:DeepMind研究员与神经符号派激辩LLM数学边界(4 条相关)→
「研究」频道最新
- Yoav Goldberg:「后训练只是塑造行为」教条已不成立,知识确被注入 — yoavgo · 2026-10-03
- 意识科学家 Anil Seth 回击 Steve Yegge:反机器意识并不等于人类中心主义 — anilkseth · 2026-10-03
- Yacine 放话:PPO 加小型 RNN 就够,模型参数不超百万 — yacineMTB · 2026-10-03
- Yacine 荐 PufferLib:讨论 RL 世界模型仿真时的开源参考 — yacineMTB · 2026-10-03
- Hutter 等新论文:理解泛化需要通用归纳与视角化 Solomonoff 归纳 — examachine · 2026-10-03
- NVIDIA 团队获 Biohub 细胞追踪 Kaggle 赛第 10 名,约 4000 队参赛 — JFPuget · 2026-10-03