antirez 指出 DeepSeek v4.1 在 DeepSWE 上跑赢 Mistral Large 4
antirez · x · 2026-10-07
Redis 作者 antirez 发帖称,DeepSeek v4.1 在 DeepSWE 1.1 基准上的得分高于 Mistral Large 4,其他基准也类似。他表示乐见欧洲涌现更多大模型,但对选择性挑选对比对象的宣传方式不满。
「模型」频道最新
- ChatGPT 传闻取消免费用户文字聊天上限并升级默认模型 — hey_abusiddik · 2026-10-07
- Google 开源 EmbeddingGemma 2:191MB 内存跑文本嵌入,手机端离线多模态 RAG — Saboo_Shubham_ · 2026-10-07
- 5060 Ti 16GB 跑 Qwen3.8 Flash Next IQ1_M:55 tok/s 还能写出像样落地页 — bobaburger · 2026-10-07
- EmbeddingGemma 2 手机端离线跑多模态 RAG,文本仅占 191MB 内存 — Saboo_Shubham_ · 2026-10-07
- Paradigm 发布数学推理模型:7 项高难基准评测套件全开源 — tensorqt · 2026-10-07
- Limite 1B 借鉴 nanogpt speedrun 架构,用 NorMuon 训练 — tensorqt · 2026-10-07