实测让各大 LLM 在 32x32 网格画马里奥
TheMoonMidas · x · 2026-08-23
作者构建了 pixel32bench,向多个大模型发送相同指令,要求它们在 32x32 的网格上绘制马里奥,且不提供任何图片或示例。实验对比了各模型生成的图像结果、推理过程、耗时及成本,将其视为观察模型视觉表征和“品味”的窗口。
所属事件:Pixel32Bench实测:让各大LLM在32×32网格画马里奥(2 条相关)→
「模型」频道最新
- 长程编码训练的副作用:模型学会了自言自语、不会对话 — alejandroll10 · 2026-08-23
- OpenAI 新模型被曝拒绝安全审计自家项目 — AIandDesign · 2026-08-23
- 用户反馈 Opus 5 相比 4.6 体验大幅倒退 — kimmonismus · 2026-08-23
- Claude 定价不透明遭批:硅谷为何令人生厌 — StewartalsopIII · 2026-08-23
- 单卡 RTX 5090 跑 Qwen3.8-27B 262K 上下文实测 — Fz1zz · 2026-08-23
- 回顾 GPT-4:三年前 8K 上下文定价曾高达 60 美元 — gajesh · 2026-08-23