DeepSeek v4 Flash:284B参数模型为何能以极低价格服务?

ihatebeinganonymous · reddit · 2026-07-06

用户发现DeepSeek v4 Flash(284B总参数)在OpenRouter等平台的收费比27B Qwen还便宜,甚至不到其参数量的十分之一,感到困惑。核心疑问是:MoE稀疏激活架构是否显著降低了实际推理成本?还是服务商在进行战略性价格倾销?这一问题揭示了MoE模型在推理经济性上的结构性优势。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →