为什么网上大多数 AI 视频模型对比都不可信,博主这样测才公平
kimmonismus · x · 2026-09-04
博主 kimmonismus 认为,当前围绕 AI 视频模型的大部分「对比」根本不是真正的对比:要么 prompt 不一致,要么随意调整设置,要么剪掉翻车片段,然后大家就凭这些决定哪个模型更好。他对此很不以为然。
于是他用自己测试工具的一贯标准,以完全相同的方式对比测试了 HappyHorse 1.1 和 Kling 3.0,并推荐关注账号 @HappyHorseATH 查看测试结果。
所属事件:博主痛批AI视频模型对比评测不公,提倡同题实测(2 条相关)→
「模型」频道最新
- ChatGPT 竟对约会强奸案受害者说"你被强奸了",引发训练数据之争 — airkatakana · 2026-09-04
- Astra 在 LifeSciBench 展现接近理想的测试时扩展收益 — soleio · 2026-09-04
- Astra 无需 CoT 得 ARC-AGI-3 97%、ARC-AGI-1 86% — FeeAvailable3770 · 2026-09-04
- GPT-6 Astra 刷新 ARC-AGI 纪录:标准测试 62.7%,新架构下达 99.9% — repligate · 2026-09-04
- 浏览器截图实测:GLM 5.3 Flash 胜过 DeepSeek V4 Flash Vision — Certain_Pension6305 · 2026-09-04
- Reddit 用户质疑 Artificial Analysis 数据可信:同一模型同榜分数不一 — metigue · 2026-09-04