LLM 智能与单任务成本对比: frontier 模型优势明显
CuriousCustard63 · reddit · 2026-08-28
基于 Artificial Analysis 的数据,作者生成了最新的 LLM 智力指数与单任务成本对比图。图表展示了 frontier 大公司模型、其他旗舰模型及开源权重模型在智能与成本上的分布情况,列出了各供应商“最智能”的模型。数据由 Gemini 提取并绘图,Claude 完成校验。
「模型」频道最新
- ExploitGym 评分器疑现 bug,拖累 GPT-5.5 等模型成绩 — TheZvi · 2026-08-28
- 混元Hy4发布,腾讯阿里字节三家模型迈过可用线 — AlchainHust · 2026-08-28
- GPT 5.6 Sol 独立运行 14 小时实测 — p_e_cooper · 2026-08-28
- Meta 正研发对标 Anthropic 的新模型 Watermelon — Terminator857 · 2026-08-28
- GLM-5.3 Flash 搭配 DFlash2 推理速度大幅提升 — No_Afternoon_4260 · 2026-08-28
- 腾讯混元 Hy4 Preview 全方位基准测试成绩曝光 — badumtsssst · 2026-08-28