圈内人实测:DeepSeek V4.1 基准偏低但速度快 4 倍
teortaxesTex · x · 2026-09-14
网友 @usrbinroygbiv 分享用后观感:DeepSeek V4.1 在公开基准上排名几乎垫底,但个人实际使用体验仅排在 astra 和 GLM 5.3 之后,且运行速度约是其他模型的 4 倍,他猜测部分原因在 OMP。
teortaxesTex 附议并调侃:围绕 TB 2.1 与 TB 4.0 排名差异的「刷榜」讨论很可笑——V4.1 几乎是「反刷榜」之作,DeepSeek 显然不在乎基准成绩,甚至不太在乎用户体验,它更像一个内部 Whale AGI 研发套件的产品。注:相关版本信息均为社区观察,未经官方证实。
「模型」频道最新
- GPT-6 实测视频:独立做出 Fall Guys 风格小游戏 — Matthew Berman · 2026-09-14
- 网友实测与 DeepSeek 玩 GeoGuessr:VLM 定位能力相当不错 — PMinervini · 2026-09-14
- 评论人称 Anthropic 炼书训练致百万书籍原文失传 — StewartalsopIII · 2026-09-14
- 书生发布 397B 开源模型 Intern-S2,多模态与 Agent 能力加持,vLLM 零日支持 — Nunki08 · 2026-09-14
- 4GB 显存求推荐:擅长写作的小型本地 LLM 怎么选 — Mysterious-Comment94 · 2026-09-14
- X 网友称传阅的 Astra/Fable 参数远小于 10 万亿,模型规模已难对应能力 — teortaxesTex · 2026-09-14