组织用户今年年均切换模型从 8 款升至 12 款,混合均价降 82%
Tiancaixinxin · x · 2026-10-08
一份关于组织级 AI 模型使用格局的数据观察:
模型切换加速
- 组织用户平均使用模型数从 1 月的 8 款升至 9 月的 12 款。
- 文件读写、shell 执行、DevOps 配置、前端 UI、调试、SQL 等任务快速迁移到新模型。
- 安全审计、研究、金融交易、数学、写作、角色扮演、客服等任务用户偏好固定模型。
市场格局
- Anthropic 与 OpenAI 竞争激烈,份额约 55% 对 45%。
- Anthropic 今年 4 周滚动留存领先,第 12 周留存率 24.8%。
- Claude Opus 5.5 整合了 Anthropic 的支出,外流窗口尚未出现。
- GPT Luna、Sol 吸收其他模型用量,GPT Astra 则创造了全新支出。
成本与开源趋势
- Agent 缓存命中率更高,新模型优化后超 90%,混合平均每 token 成本从 $0.77 降至 $0.14。
- 开源权重模型占比从 1 月约 25% 升至 9 月约 60%,其中约 70% 的周 token 来自中国开源模型。
所属事件:OpenRouter 数据:Jev 两周占 32% 请求,换模频率大增(2 条相关)→
「Infra」频道最新
- 摘要字段逐轮膨胀:月 140 万会话的 agent 成本翻四倍之谜 — Good_Education4713 · 2026-10-08
- National Compute 向白宫捐赠 1 亿美元算力额度 — typewriters · 2026-10-08
- 求助:64GB 内存+16GB 显存,值不值得从 Qwen 3.6 35B 换 Flash-Next — msalsas · 2026-10-08
- vLLM 集成 DeepSeek 内核,10 万级吞吐下 TTFT 降近 70% — vllm_project · 2026-10-08
- 黄仁勋与纳德拉 Surface 活动同台,新机搭载 RTX Spark — nvidia · 2026-10-08
- 三周优化,vLLM 上 DeepSeek-V4.1-Flash 吞吐提升 5.3 倍 — vllm_project · 2026-10-08