不改权重、18MB KV 缓存即可按请求移除 LLM 拒答行为

Anony6666 · reddit · 2026-09-22

开发者发布开源项目 phantom-kv:一种不动模型权重的「去拒答」方案。它把一个约 18MB、离线训练得到的 key/value 张量库注入模型 KV cache,让注意力机制像读取对话历史一样被影响,实现按请求热切换的「解锁模式」,卸载缓存后模型与原始权重逐字节一致。

注:该技术本质是绕过模型安全护栏的手段,涉及 AI 安全争议。

所属事件:phantom-kv 开源:18MB KV 注入即可移除 LLM 拒答(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →