大家在找能准确描述露骨图片的“无审查”VLM
TekeshiX · reddit · 2026-08-04
有人在问:哪一个 LLM/VLM 最适合做图片描述,尤其是带 NSFW 内容的图像描述。
- 他们之前用 Gemini 配合 jailbreak prompt 给露骨图片做 caption,再把生成的描述拿去给 WAN 2.2 做视频生成。
- 但 Gemini 现在已经会拦截这些图片,于是开始找替代方案。
- 贴子里提到 Qwen3.5-VL、InternVL、Gemma 4 和 JoyCaption,并在纠结是否需要“uncensored / abliterated / heretic”版本。
- 另外还限定了 16–48GB 显存预算,且无论是否能跑在 ComfyUI 都可以。
所属事件:开发者探讨寻找无审查的图像描述大模型(2 条相关)→
「模型」频道最新
- Qwen3-VL-32B 衍生版在 Hugging Face 上热度上升 — ethanfel · 2026-08-04
- 放狠话:若 DeepSeek 完美完成此任务,我将转投 AI 看空阵营 — yacineMTB · 2026-08-04
- DeepSeek Flash 接住了 ChatGPT 拒绝的逆向工程任务 — yacineMTB · 2026-08-04
- 一个“赢了10个菲尔兹奖”的模型,却推荐了关门两年的咖啡馆 — bosmeny · 2026-08-04
- 开源模型的一大优势仍是能看推理链 — jamesdouma · 2026-08-04
- opencode 下拉菜单里出现了加拿大模型 — yacineMTB · 2026-08-04