WHALE 提出:联合优化 LLM 权重与外挂 harness 的简单配方
lateinteraction · x · 2026-09-04
研究者 yoonholeee 发布 WHALE,一种同时优化 LLM 权重与评测/工具 harness(脚手架)的简单配方,并给出博客与论文。
核心观察:harness 优化是样本高效的,但很快到达平台期;如果预算允许连模型本身也更新,联合优化权重与 harness 能突破这一瓶颈。
附博客与论文链接。
所属事件:WHALE:联合优化 LLM 权重与外挂 harness 的新配方(2 条相关)→
「编程与Agent」频道最新
- The Pragmatic Engineer 征文:写 AI 如何改变软件工程,最高奖 1 万美元 — neal_lathia · 2026-09-04
- Cursor 订阅暗藏托管多智能体服务,或是最便宜的起步方案 — algo_diver · 2026-09-04
- 咨询师为哈佛 Opportunity Insights 研究团队定制 agentic 编码培训 — soumitrashukla9 · 2026-09-04
- 调试卡壳时:模型狂跑 1000 条命令,人类去喝杯咖啡想想 — moultano · 2026-09-04
- Astra 要记住你的纠正,Reddit 用户追问:错了怎么删 — Any-Farm-1033 · 2026-09-04
- AI Agent 自学开源仓库后,自主为 Microduck 造出交互应用 — nptacek · 2026-09-04