专题 · FULL STORY
DeepSeek V4.1 Flash内测与新定价曝光
9月8日消息源披露DeepSeek V4.1 Flash以中间版本形式开启限时内测,主打全新架构与原生多模态,输出最快每秒507 tokens,1美元可烧5800万token;随后爆料称Flash系列将于9月10日大幅降价,错峰缓存低至0.02元。
2026-09-08 ~ 2026-09-09 · 3 集 · 16 条
第 1 集 · DeepSeek V4.1 Flash 限时内测:新架构原生多模态(2026-09-08,12 条)
9 月 8 日,多个消息源先后披露 DeepSeek V4.1 Flash 已以「中间版本」形式开启限时内测,核心升级点是全新模型架构与原生多模态支持,官方口径称能力更强、速度更快、成本更低。目前内测的调用方式、计费与并发规则已基本明确,正式公开公告与完整能力评测仍待官方发布。
已确认
- 机器之心报道称 DeepSeek 官方宣布 V4.1 Flash 中间版本开始内部测试,主要升级为全新模型架构、原生多模态、能力更强速度更快成本更低;APPSO 也确认了同一消息。
- 调用方式:保持 baseurl 不变,将模型名设为以 deepseek-v4.1-flash-expires-on-09 开头的 ID(如 deepseek-v4.1-flash-expires-on-0910)。APPSO、tokenbender 等指出 slug 中的日期表明这是限时内测,版本将于 9 月 10 日过期。
- 据 vista8 转述的官方微信群通知,计费与 V4 Flash 相同,单账号最多 20 并发;teortaxesTex 提到的泄露信息同样指向并发仅 20。
- 第三方账号 LuminaBench 发现 DeepSeek 正在 API 上测试该中间构建版本,tokenbender 认为这或为正式版前哨;kimmonismus 亦称该模型已通过 API 逐步推出、速度明显更快。
尚未确认
- 消息最初由 op7418、AGI Hunt 等博主从 DeepSeek 官方微信群传出,当时均强调未经官方公开发布公告证实;后被机器之心以「官方宣布」口径报道,但正式公开公告与完整能力细节仍待官方发布。
- teortaxesTex 转引 @xhyctf 及网友调侃称希望其至少在视觉之外能打赢 GLM 5.3 Flash,仅为社区观点,无评测依据。
为什么重要
- 这是 DeepSeek 首次被曝以「中间版本(expires-on)」形式放出限时内测,且计费与并发规则同步明确,显示其在正式发布前通过开发者实测迭代的产品节奏。
- 原生多模态意味着 DeepSeek 主力模型路线的重大升级,社区已开始将其与 GLM 5.3 Flash 等竞品对标,值得持续关注正式版发布后的实测表现。
- DeepSeek V4.1 Flash 内测:调用方式与限流细节曝光 — 赛博禅心 · 2026-09-08
- 传 DeepSeek V4.1 Flash 曝光,网友调侃盼其超越 GLM 5.3 Flash — teortaxesTex · 2026-09-08
- DeepSeek V4.1 Flash 中间版本开启内测,原生多模态 — AGI Hunt · 2026-09-08
- 传 DeepSeek V4.1 Flash 发布:原生多模态增强 — op7418 · 2026-09-08
- 曝 DeepSeek V4.1 Flash 开启内测:新架构原生多模态,计费不变 — vista8 · 2026-09-08
- DeepSeek V4.1 Flash 中间版开启内测:原生多模态、更快更便宜 — jiqizhixin · 2026-09-08
- DeepSeek 疑似内测 V4-Flash-Vision:全新架构原生多模态,并发仅 20 — teortaxesTex · 2026-09-08
- DeepSeek V4.1 Flash API 低调开测:新架构+原生多模态,或为正式版前哨 — tokenbender · 2026-09-08
- DeepSeek 开启 V4.1Flash 限时内测:新结构原生多模态,9月10日过期 — APPSO · 2026-09-08
- 曝 DeepSeek V4.1 Flash 中间版本内测:原生多模态、更快更便宜 — aigclink · 2026-09-08
- DeepSeek Flash 4.1 曝已上线 API 测试,采用新架构提速 — kimmonismus · 2026-09-08
- DeepSeek V4.1 Flash 开放内测:原生多模态,价格与 V4 持平 — Nunki08 · 2026-09-08
第 2 集 · DeepSeek 开放 V4.1 Flash 限时内测,1 美元可烧 5800 万 token(2026-09-08,2 条)
DeepSeek 宣布 V4.1 Flash 中间版本开启内测,采用全新模型架构,原生支持多模态,速度更快、成本更低,输出最快可达每秒 507 tokens。开发者无需更改 baseurl,只需更换模型名即可调用。此外官方还推出限时活动:仅开放两天,价格极为激进,约 1 美元即可消耗 5800 万 token,引发社区广泛关注。
- DeepSeek V4.1Flash 中间版本开启内测:新架构、原生多模态,输出最快 507 tokens/s — 智东西 · 2026-09-08
- DeepSeek 限时放出 v4.1 Flash:1 美元可烧 5800 万 token — MicahBerkley · 2026-09-09
第 3 集 · DeepSeek新定价曝光:flash系列大降价错峰缓存低至0.02元(2026-09-08,2 条)
据 TeortaxesTex 汇总及公众号「赛博禅心」消息(待官方最终确认),DeepSeek 将于北京时间 2026 年 9 月 10 日 12:00 起调整价格体系,替代当前到期的 Intermediate V4.1 定价方案。flash 系列大幅降价,闲时输入降至 1 元/百万 token(限 20 并发),错峰时段缓存命中价格低至 0.02 元,整体呈现输出加价、错峰大幅优惠的结构。
- DeepSeek flash 系列大幅降价:闲时输入降至 1 元/百万 token,限 20 并发 — 赛博禅心 · 2026-09-08
- DeepSeek 新定价曝光:输出加价、错峰缓存命中低至 0.02 元 — teortaxesTex · 2026-09-08