Graphsignal 用 GPU 遥测自动调优 vLLM 和 SGLang 参数
l0g1cs · reddit · 2026-07-23
Graphsignal 想用 GPU 遥测自动调 vLLM 和 SGLang 参数
这条 Reddit 帖子介绍了 graphsignal-run --auto-flags:它会在启动 vLLM、SGLang 或 TRT-LLM 时,结合 GPU profile 和真实流量遥测自动选择参数。
工作方式大致是:
- 用包装器接管启动命令,根据 GPU profile 和实际 workload telemetry 设置 flags。
- 如果没有历史记录,就先按 recipes 和文档推荐值来。
- 重启时可复用上一次运行的配置,让参数逐步贴近真实流量,而不是每次都重置。
作者举的例子是:在 SGLang 上处理“高并发、短、且彼此不同的 prompt”时,prefix cache 反而成了负担;关掉后吞吐量提升了大约 3.6 倍。
「Infra」频道最新
- 为人类设计的科研栈,正在不适配 AI 科学家 — AnneliesGamble · 2026-07-23
- Alchemy beta 扩展到 204 项 AWS 服务与 Lambda 工作流 — samgoodwin89 · 2026-07-23
- 十个技巧把 AI API 账单砍掉最多 90% — socialwithaayan · 2026-07-23
- AI 定价不只是 token 问题,背后是显存和算力成本 — Kyrannio · 2026-07-23
- NVIDIA 推出 Jetson Thor T2000 和 T3000,面向机器人与边缘 AI — NVIDIAAI · 2026-07-23
- AWS 据称今年将出货 240 万颗 Trainium3 加速器 — Beth_Kindig · 2026-07-23