四大前沿模型画蒙娜丽莎实测:GPT-5.6 领先

ArtificialOther · x · 2026-08-12

TryAI 搭建了一个“绘画竞技场”,测试 GPT-5.6、Claude Fable 5、Grok 4.5 和 Gemini 3.6 Flash 四大前沿视觉模型在空白画布上仅使用彩色铅笔工具绘画的能力。

测试涵盖了客观图像复刻(如《蒙娜丽莎》)和开放式文本提示词生成。系统详细追踪了模型的每一次笔触、调用工具的成本以及最终产出。

作者指出,这类模糊的开放式任务比单纯的跑分更能直观展现模型的真实能力差异,也能有效区分前沿模型与开源模型之间的执行差距。实测结果显示,GPT-5.6 表现最佳,而 Grok 4.5 在这项基础绘画任务中显得较为吃力。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →