DeepSeek V4.1 Flash 登顶 Artificial Analysis 新基准,超 Astra
Randomdotmath · reddit · 2026-09-14
Artificial Analysis 在 Intelligence Index v4.3 更新中上线了一个取代 τ³ 的全新私有评测。此前 Astra 靠这个基准大量刷分追平 Fable,而指数三天内两次调整一度被指偏向 Astra;最新结果显示 DeepSeek V4.1 Flash 悄然登顶该基准,成为新的第一名,榜单格局再度反转。
「模型」频道最新
- 谱理论课件动画对决:Claude Opus 5 力压 ChatGPT Astra,静态图是短板 — PTenigma · 2026-09-14
- 同为数学动画,ChatGPT 静态图糟糕却做出更流畅动画 — PTenigma · 2026-09-14
- Claude Fable 5.1 用 44 分钟破解尘封 370 年的古老密码 — bcherny · 2026-09-14
- Next Token 播客更新:聊 GPT-6 Astra、DeepSeek V4.1 Flash 与 iPhone Duo — op7418 · 2026-09-14
- 网友三大测题:画鹈鹕骑车、孙悟空开飞机判断模型是否降智 — lxfater · 2026-09-14
- 月付 $200 连一个 light mode 提问都发不出去 — Beeegbong · 2026-09-14