Skill-Doctor:读取本地对话历史,精准诊断无效 Skill
aigclink · x · 2026-08-29
Skill-Doctor 是一个"给 skill 看病"的元技能,通过读取本地机器上的真实 Agent 对话历史,按效率和代码质量两个维度进行评分。
核心功能:
- 只对打分失败的会话反推问题,禁止使用通用最佳实践充数。
- 例如,若 Skill 在失败会话中未触发,则判定是"触发描述"有问题。
工作流:
- 验证 harness。
- 选择评估范围(单库/全部/指定项目)。
- 采集数据(默认回看 45 天,最多 12 个会话)。
- 打分(效率、代码质量、覆盖率)。
- 聚合结果并起草具体的 Skill 修改建议。
评分公式:
Overall = 0.5×效率 + 0.35×代码质量 + 0.15×Skill覆盖率
所属事件:Skill-Doctor 上线:用本地对话历史给 Agent 技能体检(2 条相关)→
「编程与Agent」频道最新
- AI 写的代码如何做回归测试?实测 Agent 比单元测试更准 — Specialist_Agent3599 · 2026-08-29
- OpenClaw 热度骤降:从现象级爆红到时代眼泪仅用数月 — 量子位 · 2026-08-29
- 编程 Agent 记忆能否不用向量库?实验出真知 — madsthines · 2026-08-29
- 实战笔记:MCP 服务器如何同时适配 Claude 和 ChatGPT 的 OAuth — NoStrawberry1162 · 2026-08-29
- rednote 发布开源多模态智能体模型,支持 512K 上下文 — aftahi_ai · 2026-08-29
- tokenbender 炮轰速度崇拜:快是砍掉质检赶垃圾出货 — tokenbender · 2026-08-29