含 9000 图的文生图基准发布,测 52 模型
dh7net · reddit · 2026-08-27
作者发布了一个 Text-to-Image 基准测试,包含 192 个针对文本渲染、空间推理、人物真实感、否定指令等难点的提示词,并使用 VLM 作为裁判进行二值判断。
目前已测试 52 个模型,生成并分析了超过 9000 张图片。与大多数不公开图片的排行榜不同,该项目在 Hugging Face 上公开了包含提示词和结果的完整数据集,并提供 Gallery 供人眼检查结果。
链接:
- 方法论:https://imagebench.ai/methodology-v1
- 数据集:https://huggingface.co/datasets/dh7/imagebench
- 代码库:https://github.com/dh7/image-bench-ai
- 排行榜:https://imagebench.ai/imagebench-v1
「多模态」频道最新
- MiniMax H3 Max 后训模型:视频生成提速 50 倍 — Recoil42 · 2026-08-27
- MiniMax-H3 演示:不仅能换人还能自动加特效和背景 — solomars3 · 2026-08-27
- 实测 Google Gemini 3.5 Transcribe:混乱 LoL 直播也能准确实时转录 — ming_calligraphy · 2026-08-27
- H3 Max实测:6.6秒生成士官长拜访《老友记》 — chrisfirst · 2026-08-27
- ComfyUI 联手 MiniMax 举办声画同步挑战赛 — Comfy-Org · 2026-08-27
- Gen2Physics:通过多视图材质分解实现 3D 物理模拟 — kwangmoo_yi · 2026-08-27