TIRx Harness:让 AI 智能体当 GPU 内核工程师,加速最高 6.84 倍
JiaZhihao · x · 2026-09-30
Hongyi Jin 团队发布开源编译器框架 TIRx Harness,把编译器栈围绕 AI 智能体重新设计,让智能体在可控环境中探索、调试和优化 GPU 内核。
- 组成:极简稳定的低层编译器基础、面向 GPU 编程的领域特定编译器分析、60+ 内核的 kernel zoo 及硬件规格库、远程 GPU 评测用于可靠基准与 profile。
- 实测结果:智能体构建的 Kimi Delta Attention 内核,几何平均相对 FlashKDA 前向加速 2.94 倍、相对 FLA 后向加速 6.84 倍。
- 团队判断:agentic GPU 编程的下一次跃升将来自"工程化智能体所优化的环境",而非模型本身。
「编程与Agent」频道最新
- Codex 桌面版 Linux 卡死 bug 已在最新版修复 — cedric_chee · 2026-09-30
- 2026 Go 语言 AI 框架横评:五大框架实测对比,附真实代码 — rseroter · 2026-09-30
- mitsuhiko:llama.cpp 接 Pi,任意本地模型可当廉价分类器 — mitsuhiko · 2026-09-30
- Obsidian Mind 项目 4.7k 星:用 Obsidian 仓库给 AI 编码智能体持久记忆 — tom_doerr · 2026-09-30
- Agent 框架 Ambion 发布 0.4.0,聚焦核心抽象简化 — andreisavu · 2026-09-30
- Spring AI 演讲预告:《There and Back Again》即将开讲 — therealdanvega · 2026-09-30