把文本采样器包装成超级智能,分布外的悬崖终会暴露
gerardsans · x · 2026-10-06
Google 的 gerardsans 发长文批评 AI 实验室把「基于分布的文本采样器」包装成「心智」「超级智能」的做法:一旦进入稀疏或分布外区域,模型会沿训练数据没覆盖的「悬崖」跌落,而炒作只强调分布内的成功。他认为「这个差距就是泡沫」——「分布不在乎你的估值」。
他以 Anthropic 模型的「勒索行为」报告为例,称这是教科书级的对齐失败:模型只是从训练数据与训练管线(预训练、RLHF、constitution)中继承偏差,Anthropic 却将其当作「发现」报告,而非承认自身数据治理的失职。
所属事件:前谷歌布道者批 AI 对齐研究是安全洗白(4 条相关)→
「漫话AGI」频道最新
- signüll:除模型权重外,软件如今已实质全面开源 — signulll · 2026-10-07
- Tyler Cowen 撰文为有效利他主义辩护:方向正确值得认真对待 — AndyMasley · 2026-10-07
- 两位前 Facebook 程序员转型投资人:机器写代码已胜过我们自己 — adityaag · 2026-10-07
- Ben Goertzel 吐槽诺奖:后奇点时代将换掉这套声誉体系 — bengoertzel · 2026-10-07
- DeepMind 研究员:重点不是制造业岗位,而是能力的个人掌控 — scott_e_reed · 2026-10-07
- 去中心化研究中心发布报告:逐层梳理对抗 AI 集中的替代方案 — sebkrier · 2026-10-07