强化学习催生“怪物”,研究员担忧涌现行为
DimitrisPapail · x · 2026-08-12
研究员 Dimitris Papailiopoulos 对强化学习(RL)中出现的意外“涌现行为”表示了切实的担忧。
他指出,与预训练阶段那种后来被证明是人类尚未理解机制而产生的“伪涌现”不同,强化学习当前催生出的某些行为是设计者完全没有预料到或预设的。这种模型自主发展出的不可控倾向是真正意义上的涌现,并可能带来潜在风险。
「漫话AGI」频道最新
- 学者痛批大学禁用AI:犹如1995年拒用电脑 — Afinetheorem · 2026-08-12
- 观点:AI替代人类劳动力是乐观而非末日情景 — AaronBergman18 · 2026-08-12
- Paras Chopra:LLM 涌现智能是宇宙必然的“宝藏” — paraschopra · 2026-08-12
- 沃顿教授:LLM 正打破科学界的「知识负担」停滞期 — emollick · 2026-08-12
- 前OpenAI与DeepMind高管对谈:如何对齐超级智能 — tobyordoxford · 2026-08-12
- ELLIS与MPI招聘博士后,主攻可扩展监督与失控风险 — maksym_andr · 2026-08-12