开发者实测:小模型做越狱提示词预筛,比 GPT Luna 更准更便宜

mayfer · x · 2026-09-17

开发者 mayfer 用名为 Jev 的模型搭建了一个越狱提示词检测器,实测效果超过 gpt luna,且成本低廉,适合作为 prompt 预筛方案。他指出越狱请求通常与真实用户请求形态差异明显,容易用小分类器识别;目前只是很粗糙的初次尝试,他认为针对已知越狱模式可以将准确率做到接近 100%。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →