Weco 预印本:agent 八天自主改进自身软件七项,提升泛化到四个保留基准
VraserX · x · 2026-09-25
VraserX 引用 Weco 的新预印本反驳「模型外一切都只是 wrapper」的流行论调:该研究让一个 agent 在八天自主运行中对自身软件做出七项改进,且这些提升迁移到了四个保留(held-out)基准上——底层模型全程未变。结论是:改进 agent 的搜索策略、上下文管理和自我检查机制,本身就可能带来很大收益,而不只是依赖模型升级。
「编程与Agent」频道最新
- 别忙于修补模型错误:把个人上下文喂给 AI 才是长期资产 — chaseleantj · 2026-09-25
- fable-advisor 上线:一个会话同时榨干 Claude 和 ChatGPT 订阅 — daniel_mac8 · 2026-09-25
- Lemmalog:用 Rust Datalog 引擎做 Agent 记忆,替代向量库 — JeremyCMorgan · 2026-09-25
- Obsidian Starter Kit v4:把笔记库变成带 MCP 的强类型 AI 知识库 — dSebastien · 2026-09-25
- 72 美分找到 20 个销售线索:RouterGrowth 发布「面向销售的 OpenRouter」 — aliscodes · 2026-09-25
- Agent「自主纠错」是当前最大谎言:失败常恶性循环烧掉4万token — Brute125 · 2026-09-25