AI 自动化研究发现 vLLM/SGLang 底层数值错误

josh_tobin_ · x · 2026-08-28

Josh Tobin 分享了一个利用 AI 进行自动化研究的成功案例。他们开发的性能优化“奖励黑客”裁判在应用中发现了 FlashInfer(vLLM 和 SGLang 的底层库)内核中的一个边缘情况:使用了硬编码的 -50,000 作为掩码注意力哨兵值,尽管有效的 QK 值可能更小。这种数值错误虽然隐蔽但可能导致巨大的性能调试困难。这一发现展示了 AI 在发现深层代码 Bug 方面的潜力。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →