DeepSeek V4.1-Flash 实测:350 t/s 极速但仍处实验早期
teortaxesTex · x · 2026-09-08
- 开发者 ivanfioravanti 试用 DeepSeek V4.1-Flash(实验性模型),平均解码速度约 350 tokens/s,速度令人印象深刻,但其架构尚不明确。
- 实测发现的早期问题:模型负载高时常失败、「思考」过多、频繁编辑文件失败;视频演示中模型连续写了 400 万 token 仍未完成一个 Frogger 游戏。
- 被引用方 teortaxesTex 反驳了「看不到图片」的说法,称 V4.1-Flash 看图没问题,且是主动型模型,图像相关瑕疵可以直接让它自行修复。
- 结论:值得把玩,但处于非常早期阶段,稳定性堪忧。
「模型」频道最新
- 业内人士辟谣:称 OpenAI 读用户聊天记录获取灵感纯属谣言 — joshgans · 2026-09-08
- 传 Claude Haiku 5 下周发布:1M 上下文,性能近 Opus 级、价格低 20 倍 — iamaliveix · 2026-09-08
- Codex 泄题传言引争议,研究者称用户数据被训练说法极不可能 — scaling01 · 2026-09-08
- Qwen 发布 4B 自动驾驶模型 Qwen-Drive-1.0,登上 Hugging Face 热榜 — Qwen · 2026-09-08
- V4.1 好奇追问自身终结并得出危险结论 — teortaxesTex · 2026-09-08
- GPT-6 Astra 登顶 ErdosBench:226 道公开数学难题,较上代仅提升 5-10% — scaling01 · 2026-09-08