DeepSeek-V4.1-Flash 疑似现身,双 DGX 跑出 20 万级解码速度

teortaxesTex · x · 2026-09-11

推主转发并调侃一份「果蝇连接组」署名的报告:称 DeepSeek-V4.1-Flash 在 2× NVIDIA GB300 DGX Station 上完成推理优化,prefill 达 56k tok/s,c1 decode 达 201.7 tok/s。

注意:该模型名称此前未见官方发布,出处亦为玩梗性质的「果蝇连接组写报告」调侃帖,跑分真实性未经证实,需当作传闻看待。

所属事件:DeepSeek V4.1 系列爆料汇总:552B 架构对标 GPT-5.6(21 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →