YC AI Office Hours:Wafer 延迟比 Cerebras 低 44%
ycombinator · x · 2026-09-27
YC 为其「AI Office Hours」项目——让创业者与 YC 合伙人的 AI 版本对话获取创业建议——选型时对比了多家推理服务商。
关键数据:
- Wafer 上跑 GLM-5.2 平均延迟 379 ms,Cerebras 上跑 Gemma 4 31B 为 674 ms,低 44%,且模型更大
- YC 先测试了轻量级 Gemma 和 OpenAI 模型,最终改为使用 Wafer 的专用端点
- Wafer 的 agent 针对,YC 的请求速率、缓存命中和输入输出长度调优了 serving 配置
- 用户在 Wafer 上与 AI 合伙人的对话时长比其他供应商多 2.5 分钟
「Infra」频道最新
- ASML 欧洲收入为零,「无芯片厂在建」引产业悲观论 — pstAsiatech · 2026-09-27
- Agent 让 GPU 需要更多 CPU:三大数据点验证预测 — tengyanAI · 2026-09-27
- Yacine 猜测:DeepSeek 用「粮食自行车」对垒美国算力卡车 — yacineMTB · 2026-09-27
- Cloudflare Workers 新增零依赖 OpenTelemetry 追踪 API — irvinebroque · 2026-09-27
- 4 张 8GB 3060 Ti 跑 Qwen3.8-27B:单 agent 120 t/s、150k 上下文 — DontWinFrensWthSalad · 2026-09-27
- 单用户加装第二张 3090 后没感受到收益,求双卡用法建议 — BlueSky4200 · 2026-09-27