MOSS-VL 推出量化版本,24GB 显存即可本地跑多模态

huggingface · x · 2026-08-12

OpenMOSS 团队发布了 MOSS-VL 系列模型的 FP8 和 NF4 量化版本,涵盖图像、视频及实时流媒体理解能力。其中,MOSS-VL-Instruct 针对本地推理和批处理优化,MOSS-VL-Realtime 专为摄像头和直播等连续视频分析设计。经量化后,模型可在 24GB 显存下稳定运行,大幅降低了本地部署多模态大模型的硬件门槛。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →