哈佛实测:多模态 LLM 评图像创造力,与人类相关性达 0.68

DynamicWebPaige · x · 2026-08-15

一篇来自哈佛与宾州州立大学的 arXiv 新论文(编号 2606.29672)研究了多模态 LLM 能否零样本充当图像创造力评委——即不做任何微调、不给人类评分示例,直接给作品的原创性打分。发帖人调侃:看完模型们辛辣的点评,都不敢让 Gemini 或 Claude 评价自己的画了。

研究设计

主要发现

模型点评的风格相当毒舌,例如:"它不只是'一个带眼睛的圆锥',而是一个有故事的完整场景";也会因"拟人化物体是 AI 艺术的已知套路"而扣分——被发帖人称为绝佳的睡前读物。

所属事件:研究称多模态大模型可零样本胜任图像创造力评委(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →