OneTriangleAI 推出极低延迟 DeepSeek V4 托管
ycombinator · x · 2026-08-25
Y Combinator 孵化的 OneTriangleAI 发布了 DeepSeek V4 Flash 的托管服务,价格极具竞争力:输入 $0.15/M tokens,输出 $0.35/M tokens。团队由 MIT 毕业生和来自 Google DeepMind、Jane Street 的奥林匹克奖牌得主组成,利用 KV cache 优化实现了新的成本和延迟标准。
「Infra」频道最新
- AI 数据中心落地受阻:缺乏就业与电费上涨引发担忧 — dbasch · 2026-08-25
- SpaceX 太空数据中心:利用星链经验解决散热与供电 — XFreeze · 2026-08-25
- 如何订阅获取大量开源权重的模型? — chrisalbon · 2026-08-25
- 英伟达拟斥资 60 亿美元打造美国 AI 基础设施 — abhishekcode42 · 2026-08-25
- 英伟达 Vera CPU 演示遭质疑:对比 AMD 旧型号有误导之嫌 — zephyr_z9 · 2026-08-25
- 富士通 Monaka CPU 性能表现如何? — firstadopter · 2026-08-25