DeepSeek-V4.1-Flash 疑似现身,双 DGX 跑出 20 万级解码速度
teortaxesTex · x · 2026-09-11
推主转发并调侃一份「果蝇连接组」署名的报告:称 DeepSeek-V4.1-Flash 在 2× NVIDIA GB300 DGX Station 上完成推理优化,prefill 达 56k tok/s,c1 decode 达 201.7 tok/s。
注意:该模型名称此前未见官方发布,出处亦为玩梗性质的「果蝇连接组写报告」调侃帖,跑分真实性未经证实,需当作传闻看待。
所属事件:DeepSeek V4.1 系列爆料汇总:552B 架构对标 GPT-5.6(21 条相关)→
「模型」频道最新
- 270M 小模型 Falcon OCR 1.5 更新:硬刚大 20 倍的 OCR 模型 — HildeKuehne · 2026-09-11
- 从 Claude 转投 Codex 后水土不服:更快但更毛糙 — green_r00t · 2026-09-11
- Shisa 系列模型落地:核能图纸 AI 与多语言多智能体案例公开 — bclavie · 2026-09-11
- 用户报告 Opus 新增编码安全过滤,直接拒绝生物学请求 — iskander · 2026-09-11
- 曝 DeepSeek V4.1 Flash 将 prefill/decode 分离直接写入模型权重 — altryne · 2026-09-11
- 也门恐怖分子被曝用 Claude Code 编程火箭,引发滥用风险讨论 — davidmanheim · 2026-09-11