LLM 排行榜现新榜首,性能显著超越前代
jonathan_wilke · x · 2026-08-27
该帖宣布 LLM 排行榜网站 (lmsys.org) 迎来了新的领先者。新模型 (Claude 3.5 Sonnet, 根据 URL 推断) 在各项评测中表现优异,成功登顶,超越了之前的冠军。
「模型」频道最新
- 曝 Anthropic 将发 Fable 5.1,领先对手 3-4 个月 — bindureddy · 2026-08-27
- Gemma 4 轻松过 Google 自家 reCAPTCHA v2,作者拟再测 Qwen — Hour-Wish8158 · 2026-08-27
- 智谱 GLM-5.3-Flash 上线 OpenRouter,支持百万上下文 — AccBalanced · 2026-08-27
- Artificial Analysis 榜单:GLM 5.3 Flash 追平 Sol 5.6 Max — PilgrimofHaqq2 · 2026-08-27
- AI 进入青春期:小模型在特定领域击败大模型 — DhruvBatra_ · 2026-08-27
- TerminalBench 深度评测:GPT-5.6 领跑,多模型降级 — abeirami · 2026-08-27