RL 练习:用 LLM 复刻 FunSearch 优化装箱启发式

有开发者分享了代号为“Bubbles”的强化学习练习,任务为解决装箱问题,方法受 FunSearch 启发,由 LLM 参与启发式算法的设计。另一位用户在做同一练习时复刻了 FunSearch 思路:让 LLM 扮演交叉算子,在进化过程中顺便优化自己的调度脚本,展示了 LLM 与进化搜索结合在组合优化问题上的实践价值。

2026-08-25 ~ 2026-08-25 · 2 条相关