实验揭示 Claude Skill 短板:会话历史会压过技能文件规则
KhuyenTran16 · x · 2026-10-06
Khuyen Tran 分享一个一手实验:skill 文件本应给模型稳定规则,但她发现模型一旦违反过一次,即使被纠正,后续仍会延续坏模式,似乎会话历史比 skill 文件权重更高。她用 commit-message 规则做了对照实验——只改变早期会话历史,观察最终答案是否仍遵守规则。文章给出实验设置、结果,以及让 skill 规则更可靠的实用习惯。
「编程与Agent」频道最新
- PE 被投企业 AI 落地实战:20+ 命令工具包与自动化审查 agent — alex_verem · 2026-10-06
- 谁来监督 AI?答案是另一个 AI:企业 agent 治理将分层化 — shaunralston · 2026-10-06
- Autonomous Lamp 开源桌面伴侣机器人开卖:$499 搭 Jev 分层大脑 — dee_hw · 2026-10-06
- invideo 推出 MCP:接 250+ 模型搞定文生视频全流程 — aziz4ai · 2026-10-06
- Harvey 换 harness 后 7 模型均分 23.3%→62.4%,成本还降 60% — rajistics · 2026-10-06
- 同款模型换 harness 提分 23%→62%,作者称性能瓶颈不在模型 — rajistics · 2026-10-06