开发者微调 Qwen3-VL-2B 复刻 Jev 风格图像分类,追问仅加 3ms
Taronyuuu · reddit · 2026-09-22
Reddit 用户基于 Qwen3-VL-2B 做了全量微调(双 RTX 3090、约 2.8 万张图),复刻 Jev/Typesafe.ai 风格的图像分类推理,重点是单图连续多问场景:首个问题之后每个追加问题仅需约 3ms。数据中含 NSFW 图片,作者主要用途是用户上传图片的 NSFW 识别。模型已在 Hugging Face 开源(Qevi-2B)。
「模型」频道最新
- 用户吐槽 Claude xhigh/ultracode 模式比 opus high 更急躁烦人 — MarvinTBaumann · 2026-09-22
- 模型图表重绘能力明显进步,博主长期测试首见惊艳结果 — Wattenberger · 2026-09-22
- 马斯克晒 Grok 4.7 在 Tesla 干真工程,FSD 功能靠过夜 agent 交付 — elonmusk · 2026-09-22
- 开发者实测 Qwen3.8-max-preview xhigh:连续跑了近 24 小时额度未尽 — jasonkneen · 2026-09-22
- 马斯克官宣 Grok 4.7,演示分钟级生成 3D 喷气引擎交互可视化 — elonmusk · 2026-09-22
- GPT-6 Sol、Luna 与 Astra Minor 曝现身 Azure 模型配置 — 141_1337 · 2026-09-22