DeepSeek模型成本仅为月之暗面零头,长文本推理极具价格优势
teortaxesTex · x · 2026-07-31
推文讨论了 DeepSeek 模型在成本上的巨大优势。作者指出,尽管 Moonshot(月之暗面)可能保持着较高的利润率,但 DeepSeek 的模型在本质上要便宜得多,尤其是在处理长文本时,单次会话成本甚至能低至对手的 1/50,且对部署的硬件要求极低。
在引用的讨论中,有人猜测 DeepSeek 巨大的性能飞跃可能仅仅是因为生成了更多的训练环境并进行了更多的强化学习(RL)步骤。作者对此表示认同,并强调 DeepSeek 的训练配方绝不逊色于 Moonshot,且最终提供的模型价格便宜了 17 到 100 倍。
所属事件:DeepSeek V4-Flash 跑分曝光,性能暴涨逼近 GPT-5.6(18 条相关)→
「模型」频道最新
- 同价位大模型实测:DeepSeek V4-Flash 多模态胜过 GPT-5.6 Luna — teortaxesTex · 2026-07-31
- DeepSeek V4-Flash 性能暴涨,或因 V4-Pro 充当 RL 教师 — teortaxesTex · 2026-07-31
- DeepSeek 推理 RL 训练受赞,规避模型废话与幻觉 — teortaxesTex · 2026-07-31
- 实测对比:o3 在 OSINT 任务中表现依然强悍 — bytebot · 2026-07-31
- 曝 Gemini 3.5 Pro 或于本周末发布 — gaganghotra_ · 2026-07-31
- Kimi RL 训练实力获赞:有效避免幻觉与废话 — teortaxesTex · 2026-07-31