哈佛 MIT 论文 FINSKILLOPS:把失败变成带回归测试的技能补丁
rohanpaul_ai · x · 2026-09-22
哈佛、MIT 等机构论文提出 FINSKILLOPS,一个面向 SEC 财报问答的自进化多智能体系统。
- 核心思路:把部署后改进定义为"受控行为维护"——反复出现的失败应转化为带作用域的技能补丁(skill patch),每个补丁须通过验证才能上线。
- 治理机制:基于证据的类型化失败诊断生成可复用技能,通过定向验证、保护用例回归检查、阴性对照和版本化替换/退役来管理,拒绝引入回归的修复。
- 效果:在六个金融 QA 基准上,单一冻结技能注册表在裁决加权正确性和引用一致性上取得评测系统中的最高分。
作者认为这能把静态 RAG 系统变成能从失败中持续学习、且安全更新回答方式的系统。
所属事件:哈佛MIT推出FINSKILLOPS:让金融AI带回归测试地从错误中学习(2 条相关)→
「编程与Agent」频道最新
- 小米 MiMo 团队发布 CodeMIDAS:从代码本身扩展智能体 RL 环境 — _akhaliq · 2026-09-22
- 新研究:浏览器 Agent 仅凭页面与历史即可预测你的下一步操作 — aidangch · 2026-09-22
- 美团发布企业级 Agent 平台 CatPaw,内部已服务 9 万员工、3 万活跃智能体 — bookwormengr · 2026-09-22
- 开发者用 Grok 4.7 用 C 语言写游戏引擎:真的很好用 — elonmusk · 2026-09-22
- 开发者实测:Mimo-v2.6 替换 Opus 接手客户项目,“是个猛兽” — MicahBerkley · 2026-09-22
- Kev 重构至 Qwen3.5,开源小决策模型更新 0.8B/4B/9B 三档 — alexcovo_eth · 2026-09-22