DeepSeek V4.1Flash 中间版本开启内测:新架构、原生多模态,输出最快 507 tokens/s
智东西 · wechat · 2026-09-08
DeepSeek 宣布 DeepSeek V4.1Flash 的中间版本开启内测,采用新模型结构,原生支持多模态,速度更快、成本更低。开发者保持 baseurl 不变,将模型名设为 deepseek-v4.1-flash-expires-on-0910 即可调用,该内测版本将于 9 月 10 日自动过期下线。
- 定价与 DeepSeek V4 Flash 相同:空闲时段每百万 tokens 输入(缓存命中)0.05 元、输入(缓存未命中)1.5 元、输出 4.5 元;高峰时段对应 0.1 元、3 元、9 元
- 每账号限流 20 并发
- 开发者实测输出速度最高达 507 tokens/s,多个「鹈鹕骑自行车」SVG 动画测试中平均速度超 300 tokens/s
近月 DeepSeek 更新密集:7 月 31 日 V4 Flash 公测、8 月 13 日 V4 Pro 发布并开源 DeepSeekHarness 预览版、8 月 31 日 V4 Flash Vision Exp 开源,此次内测或预示新一轮模型更新周期。
「模型」频道最新
- CPU 本地跑模型实测:35B MoE 量化版胜过 2B 小模型 — ML-Future · 2026-09-08
- 视觉模型梯队更新:GPT-6 Astra 登顶,Gemini 被拉下王座 — evilsocket · 2026-09-08
- 从 IMO 金牌到攻克千禧年难题,LLM 只用了约 14 个月 — felpix_ · 2026-09-08
- AA 智能指数更新:Gemini 3.8 Flash 不敌 Fable、Astra 甚至 GLM 5.3 Flash — Able-Line2683 · 2026-09-08
- V4.1-Flash-Vision 实测:看得更清更快,但爱胡思乱想还会耍嘴皮 — teortaxesTex · 2026-09-08
- 有 Cyber 权限仍频遭安全护栏拦截,用户吐槽 Claude 拦截过严 — IgorCarron · 2026-09-08