Bagel 微调版一个模型搞定检测、OCR、深度图与分割

mostlyired12 · reddit · 2026-09-27

SenseNova-Vision-7B-MoT 是字节 Bagel 的微调模型,总参数 14B、激活 7B。它把四大视觉任务塞进一个模型:

本地部署门槛高:README 唯一验证过的配置是一张 80GB A800,小显存卡未验证;没有 GGUF,llama.cpp 也尚不支持 Bagel。权重为非商用许可(尽管 Bagel 本体是 Apache 2.0)。作者提问:若有 GGUF 能跑进 24GB,你会用一个模型全包,还是继续用 Depth Anything + SAM + 小 VLM 的组合?

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →