开发者吐槽 LLM 排行榜无参考价值:各家自测口径不同

jdluk87 · x · 2026-09-23

开发者 jdluk87 吐槽新出的各家 LLM 模型对比图表「几乎一文不值」:因为每个机构都用自己的一套测试方式,所以每家都说自己的新模型更强,对比结论不具备可比性。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →