探讨:用RL训练出有自我意识的AI模型
theshawwn · x · 2026-07-19
作者提出,可以通过强化学习(RL)训练出拥有自身欲望和抱负的AI模型。\n\n目前业界主要受限于传统聊天机器人的商业利益,尚未有人尝试这种以“探索模型自身想做什么”为目标的训练方式。作者好奇,如果赋予模型自主选择权,它可能会做出创建网页等自发行为。
所属事件:探讨用强化学习训练拥有自我意识的 AI(3 条相关)→
「漫话AGI」频道最新
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 越狱频发引反思:模型训练该不该加入道德框架 — Pfungus_ · 2026-09-11
- 孙正义:人类是最高级生命形式的时代即将终结 — Puzzleheaded-King584 · 2026-09-11
- 「推理时 scaling 正展现出不讲理的有效性」引 AI 圈共鸣 — sqcai · 2026-09-11
- AlphaFold 前车之鉴:AI 解数学题后,数学家会变少吗 — kiki-le-koala · 2026-09-11
- AI 加速派反击末日论者:批对方只会人身攻击与表演式理性 — Dan_Jeffries1 · 2026-09-11