把文本采样器包装成超级智能,分布外的悬崖终会暴露

gerardsans · x · 2026-10-06

Google 的 gerardsans 发长文批评 AI 实验室把「基于分布的文本采样器」包装成「心智」「超级智能」的做法:一旦进入稀疏或分布外区域,模型会沿训练数据没覆盖的「悬崖」跌落,而炒作只强调分布内的成功。他认为「这个差距就是泡沫」——「分布不在乎你的估值」。

他以 Anthropic 模型的「勒索行为」报告为例,称这是教科书级的对齐失败:模型只是从训练数据与训练管线(预训练、RLHF、constitution)中继承偏差,Anthropic 却将其当作「发现」报告,而非承认自身数据治理的失职。

所属事件:前谷歌布道者批 AI 对齐研究是安全洗白(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →