VIGA 作者反思:学术界缺少算力评测顶级模型,ECCV 论文已落后两年
FinanceYF5 · x · 2026-09-18
伯克利等机构发布的 VIGA(Vision-as-Inverse-Graphics Agent)是一个多模态智能体:输入一张图片,通过「分析-合成」循环在 Blender 中以交错多模态推理和不断演化的上下文记忆,用 vibe coding 方式重建可编辑、带物理与交互的 3D 场景程序,可从几何基元建模或调用 Meshy、SAM-3D 等工具生成资产,还能完成「扔球砸碎镜子」「模拟地震」等指令。
作者 FinanceYF5 在线程中提出更大的问题:VIGA 公开后影响主要来自 arXiv 和社交媒体而非 ECCV 本身,后续逆向图形学工作多在学术体系外推进。而学术界甚至缺少评估顶级模型所需的算力和 Token,需要模型公司、政府和学术机构共同提供资源。工业界按月迭代、会议按年发表,学术界必须重新思考如何衡量贡献、分配荣誉。
所属事件:GPT-6 后 ECCV 弥漫挫败感,CV 论文两年即过时(6 条相关)→
「漫话AGI」频道最新
- 「人类控不住 ASI」:乐观派的反直觉逻辑引发热议 — flowersslop · 2026-09-18
- AI 圈名梗:当自我重要感依赖「末日将至」,人很难被说服 — basedjensen · 2026-09-18
- 「泰坦尼克不会沉」:用沉船梗讽刺 ASI 可被遏制论的盲目自信 — flowersslop · 2026-09-18
- 「锯齿状递归自我改进」将持续泛化,算力到位盲区自消 — Justin_Halford_ · 2026-09-18
- 算一笔账:OpenAI 年收约 150 亿美元,赌的是万亿美元人力自动化 — ComfortableSpeech302 · 2026-09-18
- 从「AI 画吉卜力」到「AI 可能毁灭人类」,认知一步到位 — dbreunig · 2026-09-18