自动研究 agent 发现 FlashInfer 内核数值缺陷,提交 PR 已被专家合并
timshi_ai · x · 2026-08-28
自动研究系统立功:Josh Tobin 团队此前开发过一个用于性能优化任务的 reward hacking 判定器(judge),在新的自动化研究工作中应用该 judge 时,系统发现 FlashInfer(支撑 vLLM 和 SGLang 的底层库)的一些 kernel 用硬编码的 -50,000 作为 masked-attention 哨兵值——但合法的 QK 值可以比它更小。
这类数值上错误但静默的边界情况极难排查,历史上围绕 flash attention 就有过类似争论。系统不但定位了问题,还提交了修复 PR,已被人类专家接受合并。
所属事件:AI 自动研究系统发现 FlashInfer 数值缺陷,修复 PR 获合并(3 条相关)→
「编程与Agent」频道最新
- 一文读懂 AI 模型与 Agentic Harness 的区别 — _jaydeepkarale · 2026-08-28
- AssemblyAI 拆解语音 Agent 架构 — AssemblyAI · 2026-08-28
- 客户执意要做 AI Agent,其实只需要简单的上下文记忆 — Radiant-Scarcity2333 · 2026-08-28
- 在 Docker 沙箱里,如何信任 AI Agent 修改的可追溯性? — pineconeseedling · 2026-08-28
- 用 Cursor 挑战 72 小时极限开发,从零构建 3D 大学校园 — tristanbob · 2026-08-28
- MemBukkit 开源:换个思路做 LLM 长期记忆,简单索引打平花哨方案 — AOZakari · 2026-08-28