RL 练习:用 LLM 复刻 FunSearch 优化装箱启发式
有开发者分享了代号为“Bubbles”的强化学习练习,任务为解决装箱问题,方法受 FunSearch 启发,由 LLM 参与启发式算法的设计。另一位用户在做同一练习时复刻了 FunSearch 思路:让 LLM 扮演交叉算子,在进化过程中顺便优化自己的调度脚本,展示了 LLM 与进化搜索结合在组合优化问题上的实践价值。
2026-08-25 ~ 2026-08-25 · 2 条相关
- RL 练习:用 LLM 指导装箱问题启发式算法 — cephaloform · 2026-08-25
- 「Meta-FunSearch」:让 LLM 在进化练习中顺便优化自己的调度脚本 — cephaloform · 2026-08-25