DeepSeek 发布 V4.1-Flash:百万 token 上下文,KV 缓存缩小 4 倍
matlabulous · x · 2026-09-11
DeepSeek 官方发布新架构家族中最小成员 DeepSeek-V4.1-Flash,现已上线 FLock API 平台。
- 面向 agentic 与长上下文场景,支持 100 万 token 上下文窗口
- 原生文本与图像理解,可调节推理力度(reasoning effort)
- 新架构将全局 KV-cache 占用降至 每 token 约 890 字节,比 DeepSeek-V4-Flash 小约 4 倍
- 官方定位:更高能力、更快推理、更高吞吐,并为后续更大规模模型做扩展
适用场景包括编码 agent、文档分析、视觉推理与复杂自动化。
所属事件:DeepSeek 发布 V4.1-Flash,支持百万上下文(2 条相关)→
「Infra」频道最新
- 8GB 显存还能干嘛?网友求解小模型现状与推荐 — riceinmybelly · 2026-09-11
- 西班牙新规要求 80% 逐小时绿电匹配,数据中心建设或耗资千亿欧元 — eherrerosj · 2026-09-11
- Draghi 引用 ECB 研究:AI 或每年提振欧洲生产率 0.3-0.4 个百分点 — rohanpaul_ai · 2026-09-11
- 高通新一代 Hexagon NPU 曝光:可跑 30B MoE,上下文 32K — lee_stott · 2026-09-11
- 斯坦福论文:本地+云端混合路由可省 60%-80% 算力成本 — rohanpaul_ai · 2026-09-11
- 租 GPU 踩坑实录:vCPU 数量与脚本默认值让成本差 31 倍 — Worldly_North_7213 · 2026-09-11