4B Qwen 经 SFT+RL 优化查询计划:Join Order Benchmark 提速 81%,成本仅 1200 美元

JeremyCMorgan · x · 2026-09-22

Rohan Bansal 用 4B 参数的 Qwen 模型,经 SFT + agentic RL 后训练,通过 pghintplan 输出 Postgres 查询提示,在 Join Order Benchmark 上取得 1.81 倍 geomean 提速,总成本约 1200 美元,代码已开源。

关键设计:

小模型+可验证奖励,在传统系统优化任务上击败了内置优化器。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →