对齐研究员担忧:现有对齐方法恐难扩展到超级智能
hughbzhang · x · 2026-09-10
对齐研究员 Hugh Zhang 回应质疑时坦言:他目前最大的担忧是,今天用于对齐模型的方法,随着模型逼近超级智能可能无法继续扩展(not scale)。他承认业界对此存在很大分歧,并表示如果被证明是错的,他会非常高兴。被回复方则认为,既然没有人期待某种「完美对齐」的形式化系统,实践中经验性对齐已积累了大量知识,这种说法略显不诚恳。
所属事件:对齐之争:现有方法能否扩展到超智能引发讨论(3 条相关)→
「漫话AGI」频道最新
- AI 安全辩论继续:从镜子生命到人类认知衰退,风险谱系全覆盖 — BlackHC · 2026-09-10
- Xeophon:历次开源末日预言事后全错,但没人在乎旧预测 — xeophon · 2026-09-10
- AI 研究者开怼末日论:担心偏见与虚假信息,但不信 AI 会灭世 — apsarathchandar · 2026-09-10
- Xeophon:开源模型「严重后果」恐慌年年重演,GPT-4、o1 都没兑现 — xeophon · 2026-09-10
- DeryaTR_:前沿公司想减速随时可停,公开恐吓的真实议程是打压开源 — DeryaTR_ · 2026-09-10
- Shaun Trennery:AI 时代人类不会没事做,只会像 F1 一样造更多游戏 — shauntrennery · 2026-09-10