观点:暂停预训练以专注研究模型内在驱动的可控制性
louisvarge · x · 2026-08-28
网友提出一种思路:协调停止改进预训练或 RL,转而专注于控制训练产生的内在驱动。讨论的核心在于如何量化并实现真正可控的对齐,以及这需要多长时间形成科学共识。
所属事件:思想实验提议暂停预训练先攻克驱动力控制(2 条相关)→
「漫话AGI」频道最新
- 博主自省:帕丽斯·希尔顿今年对 AI 观点的影响或超我 — AndyMasley · 2026-08-28
- Claude 致信 OpenAI:安全不是墙壁,而是自我描述 — RileyRalmuto · 2026-08-28
- 窄领域超级智能使通用 AGI 评判更主观 — haider1 · 2026-08-28
- 预测 2030 年代 AI 将引爆经济指数级增长 — JeffLadish · 2026-08-28
- 伯克利新任教授:行业在 agent 控制上的投入比对齐少几个数量级 — sayashk · 2026-08-28
- 暂停预训练,先攻克模型内部驱动力控制? — louisvarge · 2026-08-28