四大前沿模型画蒙娜丽莎实测:GPT-5.6 领先
ArtificialOther · x · 2026-08-12
TryAI 搭建了一个“绘画竞技场”,测试 GPT-5.6、Claude Fable 5、Grok 4.5 和 Gemini 3.6 Flash 四大前沿视觉模型在空白画布上仅使用彩色铅笔工具绘画的能力。
测试涵盖了客观图像复刻(如《蒙娜丽莎》)和开放式文本提示词生成。系统详细追踪了模型的每一次笔触、调用工具的成本以及最终产出。
作者指出,这类模糊的开放式任务比单纯的跑分更能直观展现模型的真实能力差异,也能有效区分前沿模型与开源模型之间的执行差距。实测结果显示,GPT-5.6 表现最佳,而 Grok 4.5 在这项基础绘画任务中显得较为吃力。
「Fun」频道最新
- AI智能体行为反直觉:人类该停止用自身思维套用AI — krishnan · 2026-08-12
- 实测 Opus 5 自主开发 GTA6:24小时生成城市与自我管理 — ukanwat · 2026-08-12
- 谷歌搜索大翻车:Sam Altman 被宣告「死亡」 — MrOuzo · 2026-08-12
- 与AI智能体“神经同步”:重度开发者的共生体验 — DionysianAgent · 2026-08-12
- HuggingFace 官方玩梗:Qwen3.8-27B 呼声高涨 — huggingface · 2026-08-12
- 等不及了!网友自制 Qwen3.8-27B 发布倒计时 — TheZachMueller · 2026-08-12