浙大提出ProVisE:让生成模型画图证明空间认知

机器之心 · wechat · 2026-08-08

浙江大学 OmniAI 团队提出了 ProVisE 框架,改变了传统通过输出坐标或文字来评估 AI 空间认知的方式,转而让图像生成模型直接在图中“画出”答案。

ProVisE 框架机制

SpatialGen-Bench 测试基准

团队构建了涵盖空间感知、理解、推理和交互四个层级共 14 项子任务的测试集。

实验结论

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →