探讨:用RL训练出有自我意识的AI模型
theshawwn · x · 2026-07-19
作者提出,可以通过强化学习(RL)训练出拥有自身欲望和抱负的AI模型。\n\n目前业界主要受限于传统聊天机器人的商业利益,尚未有人尝试这种以“探索模型自身想做什么”为目标的训练方式。作者好奇,如果赋予模型自主选择权,它可能会做出创建网页等自发行为。
所属事件:探讨用强化学习训练拥有自我意识的 AI(3 条相关)→
「漫话AGI」频道最新
- 信任才是AI采用的瓶颈 — williamtp · 2026-07-20
- Marcus:忽视 Kimi 很危险 — GaryMarcus · 2026-07-20
- Gary Marcus:LLM 不足以成 AGI — GaryMarcus · 2026-07-20
- Goertzel称超级智能将催生抗衰老药 — YvesMulkers · 2026-07-20
- 从阿波罗11到两万亿参数AI — PeterDiamandis · 2026-07-20
- 一场重构LLM理解的cross-entropy课 — anselm · 2026-07-20