DeepSeek-V4-Flash 推理实测:400 tps 速度仅需 10 美元/时
ben_burtenshaw · x · 2026-07-31
开发者分享了 DeepSeek-V4-Flash-0731 模型在推理端点上的最新运行数据:该模型可以达到 400 tokens/s 的生成速度,而在推理端点上的租用成本仅为每小时 10 美元。这展示了当前开源模型在极致性价比和推理优化方面的实力。
所属事件:实测DeepSeek-V4-Flash智能体3D任务成本不足1美元(5 条相关)→
「Infra」频道最新
- DeepSeek-V4-Flash 架构曝光:284B 总参,FP4 混合精度,原生支持百万上下文 — vllm_project · 2026-08-01
- OpenAI前员工基金重亏,但AI内存瓶颈仍是核心难题 — 0xSammy · 2026-08-01
- AssemblyAI 每日处理语音量达 YouTube 4 倍,CEO 称 TAM 扩大 100 倍 — AssemblyAI · 2026-08-01
- Red Hat 发布 Kimi K3 量化版:FP4/FP8 加速推理,质量几乎无损 — _akhaliq · 2026-08-01
- 台积电 CoWoS 产能预计 2027 年超 230 万片,大幅上修 — Beth_Kindig · 2026-08-01
- SkyPilot v0.13发布:支持HF存储直挂与跨集群批量推理 — skypilot_org · 2026-08-01