DeepSeek-V4-Flash 推理实测:400 tps 速度仅需 10 美元/时

ben_burtenshaw · x · 2026-07-31

开发者分享了 DeepSeek-V4-Flash-0731 模型在推理端点上的最新运行数据:该模型可以达到 400 tokens/s 的生成速度,而在推理端点上的租用成本仅为每小时 10 美元。这展示了当前开源模型在极致性价比和推理优化方面的实力。

所属事件:实测DeepSeek-V4-Flash智能体3D任务成本不足1美元(5 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →