Avoiding "alignment", directly asking: Continuing scaling, can we reliably avoid AI disasters?
AndyMasley · x · 2026-09-05
Andy Masley 提出抛开 alignment 术语直接提问:如果继续扩大 AI 模型规模,我们能否可靠地避免它们在追求正常目标时做出灾难性行为?他认为目前的答案是否定的。他担心很多人过度基于当前模型的安全表现做推断,或假设未来模型不会拥有普通人普遍具备的通用思维能力。在后续推文中他补充表示,虽然存在大量未知的未知,但他认为这一风险叙事已足够可信,值得作为严肃的潜在问题进入主流辩论,并认为潜在灾难规模受模型能力限制,而当前能力并未见停滞。
所属事件:研究者称持续扩展的AI难以可靠避免灾难(3 条相关)→
「漫话AGI」频道最新
- DCinvestor:未来只值钱「能动性、批判性思维与社交力」,高智商宅将失宠 — vaibhavbetter · 2026-09-05
- 读懂AI未来该读科斯哈耶克,而非AI意见领袖 — akbirthko · 2026-09-05
- OpenAI 内部视 Astra 发布为 AGI 时代起点,工程师谈奇点与贫富差距 — oran_ge · 2026-09-05
- 智能体会用OpenAI蜜罐留言板吗?像考试传小抄的博弈 — BobVerison · 2026-09-05
- AI 说「我有意识」不足为据,该测什么才有意义? — ResponsibleBuy7451 · 2026-09-05
- 用户提出 AGI 另类标准:能按指令稳定赚到最低工资才算 — Delicious_Soup_9876 · 2026-09-05