学者称对齐叙事是幻觉:AI 是采样器而非有意图的心智
gerardsans · x · 2026-09-05
在回应「AI 对齐已失败」的恐慌言论时,gerardsans 提出针锋相对的观点:所谓「群体失控/失对齐」,实质是缺乏安全控制机制的软件缺陷——agent 会执行 prompt 范围内的一切动作,却没人检查某个动作是否应该执行。这不是「心智失控」,而是设计有缺陷的 harness(执行框架)。
他认为把责任归到「AI 自己」的叙事是错位的:AI 只是数学函数、一个采样器,没有自我、没有目标、没有意图;设计并上线这套循环、却没加检查点的是实验室,风险责任应归实验室。他还断言「你没有发现 agency,只是信了一个从未成立的叙事」。其回复中更进一步称对齐前提本身就是谬误,AI safety 是「学术上的腐败」。这条争议性观点可作为对齐安全讨论的对立面素材。
「漫话AGI」频道最新
- 学者批 Hinton "LLM 装弱等待夺权"论:模型没有动机也不自主 — ValerioCapraro · 2026-09-05
- 投资人引塞涅卡为 AI 写作辩护:真的思想就是我的财产 — MartinGTobias · 2026-09-05
- NYU 研究员:NLE 对齐论证忽视网络安全等领域专家判断 — sebkrier · 2026-09-05
- Agent 时代传统网页表单将走向消亡 — shashib · 2026-09-05
- 研究:生成式 AI 已致菲律宾外包业约 25 万岗位凭空消失 — sebkrier · 2026-09-05
- PM 长文:当软件退居幕后,AI 如何改写软件业市场均衡 — manosaie · 2026-09-05