单日烧8万亿Token,DeepSeek凭极致性价比重塑Agent时代模型定价
APPSO · wechat · 2026-08-03
DeepSeek V4 Flash单日Token消耗量超8万亿,超过OpenRouter全平台日均规模。文章指出,Agent时代模型竞争的核心正从“单次智力比拼”转向“长任务性价比计算”。
极致性价比的“斩杀线”
V4 Flash在能力逼近甚至比肩部分海外旗舰模型的同时,输出价格仅为Claude Opus的约1/85。这种几十倍的价差让中间档模型陷入极度尴尬的境地,改变了开发者的默认调用选择。
低价背后的架构支撑
- 稀疏激活:总参数2840亿,但单Token仅激活约130亿参数。
- 注意力改造:采用CSA与HCA交错机制,大幅压缩计算量与KV Cache。
- 后训练优化:重点强化代码与Agent能力,通过并发沙箱等减少工具调用失败。
本地部署与商业逻辑
尽管完整模型权重达167GB,但社区已通过极低比特量化将其塞入128GB内存的Mac。此外,低价策略印证了“以极低毛利换取海量调用”的商业模式,预示着AI智能使用量将持续爆发。
「漫话AGI」频道最新
- 开发者探讨:非洲无需千亿大模型,500M-7B 本地模型更实用 — saheedniyi_02 · 2026-08-03
- 中国 AI 战略:以低价开源模型冲击美国闭源高利润市场 — wschroll · 2026-08-03
- AI生成UGC视频成本仅1美元,传统创作者面临淘汰? — aitrendz_xyz · 2026-08-03
- 马斯克:闭源与开源 AI 模型差距巨大,暗示新突破 — mark_k · 2026-08-03
- Flipkart 创始人:文明繁荣度与人均能源消耗成正比 — NirantK · 2026-08-03
- AGI 需要科学哲学的范式革命,而非仅仅是常规科学 — BasedRaddka · 2026-08-03