让 Agent「发牢骚」找 Bug:开源情感审查技能包
Beautiful-Training93 · reddit · 2026-07-30
一家合规工具公司开源了其用于 Claude Code 智能体的「情感技能包」,通过让 AI 带着特定情绪复盘任务,发现了大量传统测试遗漏的真实 Bug。
- 三种情感视角:whine(抱怨) 捕捉隐藏耦合和自相矛盾的规格;cringe(尴尬) 发现糟糕的 UX 和令人困惑的空状态;protect(保护) 识别看似错误但绝不能改的核心代码。
- 设计哲学:强制 AI 采取特定立场并只报告一个核心发现,要求附带最小修复方案和移除后的后果,有效过滤了无效反馈。
- 工程实践:所有发现以 JSON 格式记录到日志中,通过追踪「空发现率」来监控提示词健康度。该技能包支持一键安装,模型无关。
「编程与Agent」频道最新
- Cognition 实验室访谈:强化学习与推理优化正走向融合 — AAAzzam · 2026-07-30
- AI写代码人类看不懂?Claude编码工作流7步审查法 — MaryamMiradi · 2026-07-30
- 开发者用私有知识库与 CLI 搭建日历管理 Agent — mattpocockuk · 2026-07-30
- 仅靠工具调用远不够:AI Agent 生产化五大支柱 — WirelessLife · 2026-07-30
- 应对多 Agent 长期运行:开发者自研 FrankenTerm 终端 — doodlestein · 2026-07-30
- Jacq 智能体发布:跨应用协同并支持云端自主运行 — stuffyokodraws · 2026-07-30