开发者批 3D 渲染评测:同一 prompt 多试几次就能刷出更好结果
BLUECOW009 · x · 2026-09-23
开发者 BLUECOW009 认为 X 上流传的 3D 渲染评测是最没意义的评测之一:只要把同一个 prompt 多跑几次采样,就能得到明显更好的结果,成绩差异更多来自运气而非模型能力差距。
「模型」频道最新
- 第三方实测:Claude Opus 5.5 出图更精细,成本却是 GPT-6 Sol 的 13 倍 — testingcatalog · 2026-09-23
- 实测者称 Claude Opus 5.5 拥有迄今最佳视觉设计能力 — burny_tech · 2026-09-23
- GPT-6 Sol Codex 系统提示词泄露,全文超 29.4 万字符 — gaganghotra_ · 2026-09-23
- Claude 5.5 被曝持续生成用户回合,模型行为再现异常 — BlackHC · 2026-09-23
- 代码评测多是夹带私货的糊分数,开发者呼吁按领域细分 benchmark — almmaasoglu · 2026-09-23
- 信封上画草图,Grok 4.7 几分钟内做出可玩解谜游戏 Lightweave — luismbat · 2026-09-23