Berkeley 等发布 VIGA:用 Blender 闭环推理把图片重建为可编辑 3D 场景

Michael_J_Black · x · 2026-09-12

UC Berkeley、CMU、Max Planck 等机构在 ECCV 展示 VIGA(Vision-as-Inverse-Graphics Agent),一个通过交替多模态推理把输入图像重建为可编辑场景程序的 agent。要点:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →