亚马逊 ReaLVR 揭示潜在视觉推理盲区,首次扩展到 235B 模型

amazon · hf · 2026-10-01

潜在视觉推理(LVR)让多模态大模型用连续 latent token 做中间计算,而非逐步用文字表达。但 latent token 不可直接观测,难以监督。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →