开发者硬核反制 Claude 安全拦截:用 Hook 封禁上百个触发词
chaumian · x · 2026-08-07
由于对 Claude 动辄触发安全护栏感到无奈,一位开发者分享了自己的硬核反制措施:通过 style hook 强制模型在输出中剔除大量容易引发误判的词汇与反模式。
作者维护着一个不断增长的 claudebannedwords.txt 列表,目前已包含上百个词(如 attack, bank, chain 等),并通过 /ban 技能持续添加。他吐槽称,如果不这么做,模型几乎完全不可用。
所属事件:开发者利用 Python Hook 强制 Claude Code 遵守代码规范(2 条相关)→
「编程与Agent」频道最新
- OpenRouter 被曝静默吞掉推理参数,模型实测成绩大幅失真 — PawelHuryn · 2026-08-07
- AdaL 实验室发文反思:当前编程 Agent 架构无法实现真正自主 — Zachly · 2026-08-07
- Swarms 推出 MCP 服务器聚合平台,支持探索与变现 — KyeGomezB · 2026-08-07
- 开源项目 LLMRouter 支持动态路由查询至最优模型 — tom_doerr · 2026-08-07
- Narada AI 谈企业级 Agent 落地:如何攻克长流程自动化 — sehoonkim418 · 2026-08-07
- Agent Plugins规范与MCP架构实践:AI工程阅读清单 — rseroter · 2026-08-07