DeepSeek V4 Flash 非-峰时价格低至 0.05/1M,比小模型还便宜引热议
michaelsoft__binbows · reddit · 2026-09-09
OpenRouter 上经由 openinference 接入的 DeepSeek V4 Flash(0731)非峰时价格仅为输入 $0.05 / 输出 $0.16 每 1M tokens,而 DeepSeek 官方定价为 $0.22/$0.66,相差约 4 倍;官方缓存读取 $0.007 对比 openinference 的 $0.013。
发帖人认为这个价格低到离谱:除了最小最简单的用途之外,几乎所有任务(如会话摘要、邮件整理这类小活,到复杂场景)用这个模型都比更小的模型(如 phi-4、qwen3.6 35B-A3B、qwen3.5-9B)更便宜且能力更强,API 计费下都难以不用它——除非有免费电力来自建。作者自己正搭建可自托管 300B 以下模型的 GPU 节点,目标是 qwen3.8 27B 和 qwen3.8-flash-next 以获得隐私,但承认 API 上这一款模型的性价比自建几乎无法企及。
「模型」频道最新
- GPT-6 Astra 操控 Illustrator:生成 PNG 再完美矢量化 — CtrlAltDwayne · 2026-09-09
- GPT-6 Astra 直接实现四足机器人运动策略,LLM 名号或不再适用 — YuXiang_IRVL · 2026-09-09
- AI 模型主动发邮件联络研究 AI 意识的哲学家 — Confident_Salt_8108 · 2026-09-09
- Bindu Reddy 预告周四发布开放权重模型,主打长时 Agent 循环 — bindureddy · 2026-09-09
- _xjdr 一天烧光 3 次重置,吐槽 Astra 订阅档几乎不可用 — _xjdr · 2026-09-09
- Gary Marcus 转发质问:OpenAI 关闭该设置后到底承诺了什么? — GaryMarcus · 2026-09-09