4B 模型 RL 训练后查询计划比 Postgres 默认快 81%

bytebot · x · 2026-09-17

开发者 Rohan Bansal 发文介绍一项实验:用 SFT + agentic RL 后训练开源 4B 模型(Qwen),让其生成比 Postgres 默认优化器更快的查询计划,实测最高快 81%。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →