开发者微调 Qwen3-VL-2B 复刻 Jev 风格图像分类,追问仅加 3ms

Taronyuuu · reddit · 2026-09-22

Reddit 用户基于 Qwen3-VL-2B 做了全量微调(双 RTX 3090、约 2.8 万张图),复刻 Jev/Typesafe.ai 风格的图像分类推理,重点是单图连续多问场景:首个问题之后每个追加问题仅需约 3ms。数据中含 NSFW 图片,作者主要用途是用户上传图片的 NSFW 识别。模型已在 Hugging Face 开源(Qevi-2B)。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →