AI 自动研究系统发现 FlashInfer 数值缺陷,修复 PR 获合并
Josh Tobin 团队的自动化研究系统在应用此前开发的性能优化“奖励黑客”判定器时,发现 FlashInfer(vLLM 和 SGLang 的底层核心库)的某些内核使用硬编码值 -50000 作为掩码注意力标记,可能造成数值错误。系统随后提交修复 PR,已被专家审查合并,成为 AI 自动化研究在真实工程中立功的成功案例。
2026-08-28 ~ 2026-08-28 · 3 条相关
- AI 自动化研究发现 vLLM/SGLang 底层数值错误 — josh_tobin_ · 2026-08-28
- 自动研究 agent 发现 FlashInfer 内核数值缺陷,提交 PR 已被专家合并 — timshi_ai · 2026-08-28
- 自动研究系统发现 vLLM/SGLang 潜在数值 Bug — PMinervini · 2026-08-28