按基准类目拆分的 LLM 帕累托前沿:Sonnet 5.5 把 OpenAI 全部挤出前沿

DecidingToBeTheSame · reddit · 2026-09-29

Reddit 用户做了一个按基准测试类别(而非混合总分)拆分的 LLM 帕累托前沿可视化工具,发现 Sonnet 5.5 的成绩在各类目上全面上线后,OpenAI 最后一批模型被挤出了帕累托前沿。工具还新增功能:用户可选择自己的 GPU+内存配置,查看哪些模型可以本地运行,站点源码公开。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →