Qwen 开源自动驾驶 VLM 基础模型:4B 权重 Apache 2.0
AdinaYakup · x · 2026-09-09
阿里巴巴 Qwen 团队在 Hugging Face 上发布了一个面向自动驾驶的开源视觉语言基础模型。
- 规模 4B,采用 Apache 2.0 许可证,可自由商用
- 一个模型同时覆盖 3D 目标检测、occupancy 预测和 BEV(鸟瞰图)感知
- 具备较强的驾驶场景视觉问答(VQA)能力,同时保留了通用视觉语言能力
所属事件:Qwen 开源 4B 自动驾驶多模态模型 Qwen-Drive-1.0(5 条相关)→
「模型」频道最新
- 按显存选模型指南:8GB 跑 4B 近 9B 水平,24GB 首选 Qwen 27B — victormustar · 2026-09-09
- V4.1 视觉迭代能力获好评:不止网页和游戏,潜力巨大 — teortaxesTex · 2026-09-09
- Wayback Machine 实锤:OpenAI 静默修改 Navier-Stokes 论文并补引二作 — Dr_Atoosa · 2026-09-09
- 用户实测 Google Astra:缺乏主动性,被批「系统提示词级别问题」 — oyacaro · 2026-09-09
- 开发者实测混元 Hy4:游戏生成亮眼,票据审计也靠谱 — TencentHunyuan · 2026-09-09
- 腾讯混元 Hy4 预览版亮相:770B 参数、49B 激活、原生 1M 上下文 — TencentHunyuan · 2026-09-09