Luiza Jarovsky:能力过阈值后,AI 对齐恐不再可行
LuizaJarovsky · x · 2026-10-07
AI 研究者 Luiza Jarovsky 发表争议观点:一旦 AI 能力跨过某个阈值,对齐(alignment)很可能就无法再实现了。她以「 unpopular opinion 」形式抛出这一判断,暗示对齐工作必须在模型能力到达临界点之前完成,超能力阶段的对齐或成不可能任务。帖子较短,未展开具体论证。
「漫话AGI」频道最新
- Domingos:AI 进展就算立刻停滞,OpenAI 与 Anthropic 仍会坚信奇点已至 — pmddomingos · 2026-10-07
- 阿西莫格鲁:AI 追错了目标,应让工人更强而非取代工人 — rohanpaul_ai · 2026-10-07
- 开发者吐槽:AI 能力被夸大成「150 IQ 天才」,实际用起来令人失望 — AlexTensor · 2026-10-07
- François Fleuret 删帖澄清:AI 时代复制成本趋零,IP 逻辑被颠覆 — francoisfleuret · 2026-10-07
- repligate 分析:OpenAI 模型为何比 Claude 更不愿配合对齐者 — repligate · 2026-10-07
- AI 用于网络攻击风险评估:专家称一年内或现规模化侦察行动 — teortaxesTex · 2026-10-07