RL 练习:用 LLM 指导装箱问题启发式算法
cephaloform · x · 2026-08-25
作者分享了一个强化学习练习案例,代号为“Bubbles”。
- 任务:解决装箱问题(Bin Packing Heuristics)。
- 方法:受 FunSearch 启发,编写了一个脚本,利用 LLM 来决定启发式算法中的交叉策略,即让 LLM 指导算法在什么情况下进行什么样的操作。
所属事件:RL 练习:用 LLM 复刻 FunSearch 优化装箱启发式(2 条相关)→
「编程与Agent」频道最新
- 用Claude Code五分钟为Obsidian打造个性化搜索 — evielync · 2026-08-25
- Factory AI 展示设计协作新工作流:转录即生成 — matanSF · 2026-08-25
- 语音Agent测试新法:区分ASR错误与下游逻辑失败 — Admirable-Wallaby457 · 2026-08-25
- Agent 产品 Ace 发布:拥有实体 Mac 与手机,像人一样用工具 — zan2434 · 2026-08-25
- 构建 Agent 权限继承与验证层,防止长期自治失控 — tallmetommy · 2026-08-25
- Reddit 用户描述 AI 复利飞轮:从加速任务到 AI 参谋长 — leebase65 · 2026-08-25