实测 MiniMax H3:对流行文化 IP 细节掌握不足
FreeTheClanks · reddit · 2026-08-05
一位用户对 MiniMax H3 模型的流行文化 IP 知识进行了实测。测试发现,该模型对《荒野大镖客 2》等作品的角色外貌还原较好,但在声音识别上存在缺陷;对《少年泰坦》原版动画几乎不了解;对《绿野仙踪》完全缺乏认知。在《史酷比》测试中,模型难以准确区分角色声音,容易将 Casey Kasem 等配音员混淆。
「模型」频道最新
- Rabdos 发布数学推理评测,Claude Opus 5 领先 — prof_g · 2026-08-06
- 实测 Claude Sonnet 5:中途修改系统提示词模型竟毫无反应 — BLUECOW009 · 2026-08-06
- 闭源模型安全拦截过度,开源权重优势凸显 — robleclerc · 2026-08-06
- 单卡 1500 tokens/秒:DiffusionGemma 技术报告发布 — kastnerkyle · 2026-08-06
- ChatGPT 被指近期频繁出现严重身份幻觉 — samcharrington · 2026-08-06
- 字节发布 SeedRealtime:原生音视频全双工大模型 — iamrobotbear · 2026-08-06