微软开源 SkillOpt:像训神经网络一样训练 Agent 技能
aigclink · x · 2026-08-31
微软开源 SkillOpt,把训练神经网络的方法论搬到「训练技能文档」上:只优化 skill 文档本身,不改底层大模型权重,最终产出一份紧凑的 bestskill.md。对比人工撰写或 AI 自改后无法验证是否真的更好,SkillOpt 提供了可评估的训练路径。据介绍在 GPT-5.5 直接对话场景下,相对无 skill 基线提升 23.5 分。
它还有 SkillOpt-Sleep 招牌功能:夜间离线自我进化,收割白天会话、挖掘重复出现的任务、重放练习,通过考试的技能合并进指南。部署上零额外推理调用,不增加延迟。
所属事件:微软开源 SkillOpt:不训模型权重、只训技能文档(2 条相关)→
「编程与Agent」频道最新
- 开源 CommerceAgentBench,Qwen 跃居开源模型榜首 — Alibaba_Qwen · 2026-09-01
- 实测发现:Agent 查“此人是谁”几乎全死路 — Dry_Steak30 · 2026-09-01
- 整合 Posthog 与 Notion,Agent 自动化用户访谈与反馈闭环 — lennysan · 2026-09-01
- 用 Grok Bot 构建大学录取数据集清洗流 — lennysan · 2026-09-01
- 构想 Grok Bot 钱款漏洞猎人应用 — lennysan · 2026-09-01
- 从 Discord 机器人到多人共享 Agent 工作区:团队工作流升级记 — steipete · 2026-09-01