盲测 90 组对比:具名风格参考比形容词让模型出图好 68%
maxsloef · x · 2026-09-27
作者 maxsloef 做了一个风格引导小型评测:让 Opus 5.5、Sol 6、Kimi K3 三个前沿模型为虚构初创公司各做两版落地页,一版基于形容词组(如 dreamy、gentle、luminous),一版基于具名风格参考(如 James Turrell),随后对 90 对页面盲评。
- 结果:68% 的情况下作者更偏好具名参考版;分模型看 Sol 73%、Kimi 67%、Opus 63%。
- 即使参考由模型自己挑选,具名参考依然更有效。
- 作者为此发布了工具 Namedrop,希望实验室能据此优化模型。
所属事件:盲测显示给模型具名风格参考比形容词效果好 68%(2 条相关)→
「模型」频道最新
- ScienceArena 基准:模型做化学题遇结构图,得分掉近 10 个点 — geoffwolfe · 2026-09-27
- 自建写作基准:GLM-5.3 Flash 花 0.7 美分写出 1.7% 差距 — OnlyProggingForFun · 2026-09-27
- 从业者感叹:前沿智能已过剩便宜到用不满订阅额度 — intellectronica · 2026-09-27
- Karpathy:用 Claude Opus 4.5 学历史比读书更有留存 — doodlestein · 2026-09-27
- ChatGPT-6 Astra 两天破解 1941 年恩尼格玛密文,自写模拟器 — luisdans · 2026-09-27
- Grok 被曝将用户聊天图片上传至网络,马斯克称情况持续恶化 — EthanJPerez · 2026-09-27