Devin 接管 H100 自主实验:训练 kernel 峰值内存降 46%、延迟降 52%
AAAzzam · x · 2026-09-15
开发者将编码 agent Devin 接入 Modal 上的 H100 GPU,让它无人值守地自主跑实验循环,在一个热门开源训练 kernel 仓库上取得显著优化:
- 峰值内存降低最高 46%,延迟降低最高 52%。
- 由于 Triton kernel 已接近 HBM 带宽上限,Devin 转向其他优化点:发现反向传播每个 chunk 都在做 2GB 的冗余分配并将其移除。
- 最后自行跑 benchmark 确认了加速效果。
展示了 agent 自主进行系统级性能工程的可能性。
「编程与Agent」频道最新
- 开发者打造 Sanctuary:给 AI 智能体一个可持久存在的网上居所 — EliasBurn · 2026-09-15
- 研究机构让 AI Agent 独立经营线上生意,月薪 1 万美元招人盯管 — sdand · 2026-09-15
- Prized 让机器可秒级克隆,一台变数百台跑 Doom — thisguyknowsai · 2026-09-15
- LangChain 改进 deepagents 读文件格式:编辑错误降 15% — LangChain · 2026-09-15
- GitHub Copilot app 上线 /ask:agent 工作中可随时插话提问 — DanWahlin · 2026-09-15
- Perplexity 称 GPT-6 Astra 可全流程工作,人工检查大幅减少 — imjustnewatai · 2026-09-15