WeirdML 图表显示 DeepSeek 3.2-Speciale 后似乎停滞
teortaxesTex · x · 2026-07-28
配图是 WeirdML 的交互式模型对比图,正文则借图调侃 DeepSeek 在 3.2-Speciale 之后似乎“撞墙”了。
图里按发布时间与 17 项任务平均准确率展示了多家模型的表现,DeepSeek 的几个点位大致处在中游,而最新一批前沿模型仍继续上探。
所属事件:WeirdML 图表调侃 DeepSeek 似乎撞墙(2 条相关)→
「模型」频道最新
- 作者弃用 Opus 5,称 Fable 是唯一企业级模型 — petergyang · 2026-07-28
- Reddit 把 Opus 5 的滑条玩成了梗图 — Fragsworth · 2026-07-28
- Grok 4.5 在 CursorBench 里显得特别省 token — zainhas · 2026-07-28
- GPT 产出一条西语怪异断句,像是 typo 也像渲染问题 — Angaisb_ · 2026-07-28
- WeirdML 图把 DeepSeek 的进展做成了梗 — teortaxesTex · 2026-07-28
- Claude 截图被玩成“绝对透视”梗图 — Sauers_ · 2026-07-28