RL 练习:用 LLM 指导装箱问题启发式算法

cephaloform · x · 2026-08-25

作者分享了一个强化学习练习案例,代号为“Bubbles”。

所属事件:RL 练习:用 LLM 复刻 FunSearch 优化装箱启发式(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →