0.5B 小模型 SpatialLM 把手机视频变成带标注 3D 房间
joemeno · x · 2026-10-10
- 推主转发演示:0.5B 的小模型 SpatialLM 能把普通手机拍摄的视频转换成完整标注的 3D 房间模型,可识别墙体、门、家具及整体布局。
- 该模型以标准多模态 LLM 方式训练,但与多数只看像素的视觉模型不同,SpatialLM 理解的是空间结构。
- 项目为 manycore-research 开源仓库,已入选 NeurIPS 2025,GitHub 获 4.8k stars;2025 年 9 月发布 SpatialLM1.1-Llama-1B 与 SpatialLM1.1-Qwen-0.5B,点云分辨率翻倍并引入更强的 Sonata 编码器,数据集也已上架 Hugging Face。
「模型」频道最新
- Gemini 4 Flash 尚未官宣,社区传闻先热,用户质疑期待过高 — opmgyhx · 2026-10-10
- 理论物理学者实测 ChatGPT Astra:几乎解出全部高能物理题 — burny_tech · 2026-10-10
- 曝多家前沿模型下周密集发布,气氛堪比当年 Strawberry 前夜 — iruletheworldmo · 2026-10-10
- Unsloth 新玩法:2 分钟在 DGX Spark 上把 Qwen 微调成决策模型 — danielhanchen · 2026-10-10
- 新模型凭什么常驻你的 agent?开发者实测 M3.1 Flash Preview 后征询选型标准 — Willing_Amphibian825 · 2026-10-10
- vLLM 语义路由新招:小模型先行,省 54% 成本还提准 16 分 — vllm_project · 2026-10-10