tszzl:用近人类智能的对齐研究理解超智能对齐完全合理
tszzl · x · 2026-09-10
AI 研究者 tszzl 发推表示:用「近人类智能」(near human intelligence) 的对齐研究来理解和推断超智能的对齐问题,是完全合理的做法,并称自己从未读到过有说服力的反方论证。这一观点触及对齐研究的一个核心方法论争论:当前模型上的 RLHF、可解释性等经验结论能否外推到能力远超人类的系统。
「漫话AGI」频道最新
- 调查显示四分之一 AI 研究者给人类灭绝风险超 25% 概率 — KatjaGrace · 2026-09-10
- Beff Jezos 炮轰末日论者:担忧 1984 胜过 AI 毁灭世界 — beffjezos · 2026-09-10
- Beff Jezos 警告:监管开源 AI 或致政府国有化 Anthropic 充当武器工厂 — beffjezos · 2026-09-10
- Jacob Coxon 推文破 1.2 亿播放,AI 安全风向骤变 — scottleibrand · 2026-09-10
- AIxBio 学者:别谈苦涩教训,钱多堆算力效率其实更低 — anshulkundaje · 2026-09-10
- Naval:昨天的 AI 吃互联网平庸拼盘,今天的 AI 捕猎莫扎特 — naval · 2026-09-10