大模型梯队再排位:Fable 5 遥遥领先,Sol 与 Opus 同居 T0
bindureddy · x · 2026-08-14
AI 领域开发者 @bindureddy 基于实际使用体验,对当前的多款主流大模型进行了能力梯队划分:
- T0 独一档:Fable 5 表现最为突出,以绝对优势超越所有其他模型。
- T1 顶层梯队:Sol 和 Opus 位列此层,整体能力仅次于 Fable 5。
- T2 趋同梯队:Flash 3.7、Grok 4.6、Terra、Kimi 以及 Sonnet 被归为同一级别。作者指出,Flash 3.7 的发布只是让这个“能力高度相似”的模型阵营又增加了一员,缺乏突破性差异。
「模型」频道最新
- Devin 接入 Gemini 3.7 Flash,编程性能比肩 Sonnet 5 且成本减半 — rseroter · 2026-08-14
- 通义千问 Qwen3.8-27B 模型即将发布 — mrinterweb · 2026-08-14
- 美智库专家:DeepSeek 已落后于月之暗面与阿里 — peterwildeford · 2026-08-14
- ARC 基准测试:模型原生能力正逐渐吸收外部工具脚本 — mhmazur · 2026-08-14
- Grok 4.6 被忽视的数据:幻觉率暴降,智能体决策更可靠 — Kai_ThoughtArchitect · 2026-08-14
- 曝 OpenAI 与 Anthropic 内部模型已就绪,SOTA 迭代仍在加速 — haider1 · 2026-08-14