DeepSeek V4.1 Flash 上线 Inco,532 tokens/s 居速度榜第一
songhan_mit · x · 2026-09-18
推理服务商 Inco 宣布 DeepSeek V4.1 Flash 上线,输出速度达 532 tokens/s,按 Artificial Analysis 的数据是其平台上最快的供应商,输出速度排名第一且优势明显。
博主 songhanmit 转发并补充观点:关键不只是快,而是「迭代快」(iterate fast)——高速输出让交互式开发与试错的节奏整体加快。服务已开放试用,速度测试结果附链接。
所属事件:DeepSeek 发布 V4.1-Flash:原生视觉理解,速度登顶(3 条相关)→
「Infra」频道最新
- MLX 社区把 Qwen 3.8 Flash 在 Apple Silicon 提速近 2 倍,商用部署卡在许可证 — gajesh · 2026-09-18
- CoreWeave 宣布上线多机架 NVIDIA Vera Rubin NVL72 集群 — Beth_Kindig · 2026-09-18
- 单张 4090 复现 DeepSeek v4.1 Flash,1M 上下文跑到 1-10 tok/s — _xjdr · 2026-09-18
- All-In 对谈 Brad Gerstner:AI 资本开支谁买单、Gigawatt 缺口与半导体重塑纳斯达克 — DavidSacks · 2026-09-18
- 第三方复现 Gensyn open-1b 训练步,哈希链上可验证 — benfielding · 2026-09-18
- Anthropic 开源 Claude 撰写的 GPU 优化,30+ 生信模型平均提速 4 倍 — ResultBackground2450 · 2026-09-18