用户呼吁云厂商提升 DeepSeek 速度,期望 300-400 tok/s 极速模型
brandon_galang · x · 2026-08-05
推主观察到,尽管此前 Kimi K3 的发布曾促使各家云厂商竞相提升推理速度,但目前新兴云服务商在部署最新模型时的速度依然未达预期。
他呼吁厂商能将快速通用模型的推理速度提升至 300-400 tok/s,以满足在不需要极致智力时对极速响应的需求。
「Infra」频道最新
- 欧洲 AI 超级工厂承诺 300 亿欧元,实际仅落实 10 亿 — sanjaykalra · 2026-08-05
- Modal 优化 Serverless 架构:大幅降低网络路由延迟 — AAAzzam · 2026-08-05
- 马斯克:AI内存需求年增超200%,算力瓶颈在内存 — firstadopter · 2026-08-05
- 树莓派+Hailo 10H 实现实时本地语音助手 — martincerven · 2026-08-05
- Jane Street 前高管揭秘:如何将交易系统延迟降低两个数量级 — ivan_bezdomny · 2026-08-05
- 马斯克:AI 与机器人将引爆全球带宽需求,唯有星链能应对 — XFreeze · 2026-08-05