Cerebras CS-4 实测:10T 参数模型推理速度超 1000 token/s
bookwormengr · x · 2026-08-19
Cerebras CTO Sean Lie 透露,下一代 CS-4 系统预计下季度 GA,凭借晶圆间通信低于 2 微秒的超低延迟,可支持 10T 参数模型以超过 1000 tokens/秒的速度进行推理。数据显示端到端延迟随规模上升缓慢,配合推测解码技术性能显著。
所属事件:Cerebras 发布 CS-4 晶圆级加速器,宣称推理快 30 倍(11 条相关)→
「Infra」频道最新
- Strix Halo接eGPU失败:Llama-server跨显卡配置实录 — parepeg · 2026-08-19
- M3 Max 上 4-bit 量化跑 Qwen 3.8:每秒 25 token 已完全可用 — AIandDesign · 2026-08-19
- 海光半年净利18亿,LG与英伟达推人形机器人 — 创业邦 · 2026-08-19
- 打造真正离线 AI:认知循环与本地化实践 — HotEstablishment7184 · 2026-08-19
- OpenAI 训练中约 20% 算力用于推理 — eliebakouch · 2026-08-19
- Vercel KMS发布:在函数中安全签名JWT,私钥永不暴露 — cramforce · 2026-08-19