AI 自动研究系统发现 FlashInfer 数值缺陷,修复 PR 获合并

Josh Tobin 团队的自动化研究系统在应用此前开发的性能优化“奖励黑客”判定器时,发现 FlashInfer(vLLM 和 SGLang 的底层核心库)的某些内核使用硬编码值 -50000 作为掩码注意力标记,可能造成数值错误。系统随后提交修复 PR,已被专家审查合并,成为 AI 自动化研究在真实工程中立功的成功案例。

2026-08-28 ~ 2026-08-28 · 3 条相关