OneCanvas:一张图让普通图像模型学会3D空间推理,登顶SOTA
Roger_M_Taylor · x · 2026-10-06
NeurIPS 2026 Spotlight 论文 OneCanvas 提出把房间视频帧合并成一张全景图,让普通图像 AI 直接回答 3D 空间问题。
- 在空间推理基准上取得新 SOTA
- 可从任意视角回答问题,包括 AI 自身在房间中的位置
- 需要深度数据和相机位姿,不能只用普通视频
- 代码与模型完全开源免费
所属事件:OneCanvas 用一张全景图让 2D 图像模型学会 3D 空间推理(2 条相关)→
「多模态」频道最新
- 开发者用 GitHub Copilot 应用一键生成 60 秒产品宣传视频 — DanWahlin · 2026-10-06
- 腾讯发布新款开源权重视频模型,社区已可下载尝鲜 — Famous-Sport7862 · 2026-10-06
- 网友实测 Google Flow 上的 Nano Banana 2.1,人像质感惊艳 — aziz4ai · 2026-10-06
- TagScribeR 重构:本地数据集工作室集成原生 LoRA 训练 — ArchAngelAries · 2026-10-06
- ComfyUI 队列卡死排障清单:先分清校验失败还是进度丢失 — fluxdraw · 2026-10-06
- 首次用 Seedance 2.5 生成视频,结尾文字惨遭「鬼画符」 — atomantsmasher · 2026-10-06