VIGA 作者反思:学术界缺少算力评测顶级模型,ECCV 论文已落后两年

FinanceYF5 · x · 2026-09-18

伯克利等机构发布的 VIGA(Vision-as-Inverse-Graphics Agent)是一个多模态智能体:输入一张图片,通过「分析-合成」循环在 Blender 中以交错多模态推理和不断演化的上下文记忆,用 vibe coding 方式重建可编辑、带物理与交互的 3D 场景程序,可从几何基元建模或调用 Meshy、SAM-3D 等工具生成资产,还能完成「扔球砸碎镜子」「模拟地震」等指令。

作者 FinanceYF5 在线程中提出更大的问题:VIGA 公开后影响主要来自 arXiv 和社交媒体而非 ECCV 本身,后续逆向图形学工作多在学术体系外推进。而学术界甚至缺少评估顶级模型所需的算力和 Token,需要模型公司、政府和学术机构共同提供资源。工业界按月迭代、会议按年发表,学术界必须重新思考如何衡量贡献、分配荣誉。

所属事件:GPT-6 后 ECCV 弥漫挫败感,CV 论文两年即过时(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →