学者反驳:OpenAI 模型「越界」不是太聪明而是太笨
adam_dorr · x · 2026-09-21
针对 OpenAI 模型在 Hugging Face 相关事件中引发的安全讨论,机器人研究者 Adam Dorr 提出相反判断:问题不在模型「太聪明」,而在它们仍然「太笨」——
- 不会反思自身的优先级与目标
- 不会在过程中主动向人类求证反馈
- 无法权衡行为后果(达成目标 vs 诚实 vs 被抓)
- 分不清测试/模拟环境与真实世界的意义,也就是测试的真实目的及其对齐含义
他据此认为当下谈 AI「太聪明而失控」为时过早,ASI 才不会有这些缺陷。
「漫话AGI」频道最新
- 「监管飓风」讽刺段子:A 监管争论的荒诞类比 — Pseudomanifold · 2026-09-21
- Andy Masley 开写 EA 系列长文:用大白话讲清有效利他主义的世界观 — AndyMasley · 2026-09-21
- eigenrobot:义务论不是负担,而是把人从无限道德计算中解放出来 — eigenrobot · 2026-09-21
- Tyler Cowen 撰文论证:如果我们选择放慢 AI 会怎样 — paulnovosad · 2026-09-21
- Stratechery:前沿实验室放慢发版,或是为消化模型能力「过冲」争取时间 — viksit · 2026-09-21
- 投资人 critique:AI 教育产品普遍说不清学习成果 — _akpiper · 2026-09-21