DeepSeek V4 Flash 非-峰时价格低至 0.05/1M,比小模型还便宜引热议

michaelsoft__binbows · reddit · 2026-09-09

OpenRouter 上经由 openinference 接入的 DeepSeek V4 Flash(0731)非峰时价格仅为输入 $0.05 / 输出 $0.16 每 1M tokens,而 DeepSeek 官方定价为 $0.22/$0.66,相差约 4 倍;官方缓存读取 $0.007 对比 openinference 的 $0.013。

发帖人认为这个价格低到离谱:除了最小最简单的用途之外,几乎所有任务(如会话摘要、邮件整理这类小活,到复杂场景)用这个模型都比更小的模型(如 phi-4、qwen3.6 35B-A3B、qwen3.5-9B)更便宜且能力更强,API 计费下都难以不用它——除非有免费电力来自建。作者自己正搭建可自托管 300B 以下模型的 GPU 节点,目标是 qwen3.8 27B 和 qwen3.8-flash-next 以获得隐私,但承认 API 上这一款模型的性价比自建几乎无法企及。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →