Liquid AI 开源 d1 决策模型:3B 单次前向出答案,Jetson 上 8ms 实时决策
huggingface · x · 2026-10-08
Liquid AI 发布开源权重决策模型家族 d1,包含两款模型:
- d1-3B:基于 LFM2.5-VL-3B,支持文本+图像输入,在 Decision Index v0.2.1 公开集上得分 48.57,超过所有 10B 以下模型,与参数量 12 倍的 Decider 35B-A3B 持平。单次前向即可给出答案(不生成 token),在 RTX 4090 上 8ms、Jetson AGX Thor 16ms、Jetson Orin Nano 50ms,可在最边缘的硬件上实时决策。
- d1-omni-600M:首个实验性检查点,基于 LFM2.5-Encoder-350M 双向编码器并加装视觉/音频编码器,支持文本+图像或文本+音频,同榜单得分 15.95。
训练上,d1-3B 采用权重平均构建更优基座,再用不同种子和数据配比微调后合并;作者称长输入训练、打乱选项顺序、修复数据捷径等基础工作比高级技巧贡献更大。权重已上架 Hugging Face,可下载微调并本地部署。
所属事件:Liquid AI 开源 d1 决策模型,3B 单次前向出决策(9 条相关)→
「Infra」频道最新
- 摘要字段逐轮膨胀:月 140 万会话的 agent 成本翻四倍之谜 — Good_Education4713 · 2026-10-08
- National Compute 向白宫捐赠 1 亿美元算力额度 — typewriters · 2026-10-08
- 求助:64GB 内存+16GB 显存,值不值得从 Qwen 3.6 35B 换 Flash-Next — msalsas · 2026-10-08
- vLLM 集成 DeepSeek 内核,10 万级吞吐下 TTFT 降近 70% — vllm_project · 2026-10-08
- 黄仁勋与纳德拉 Surface 活动同台,新机搭载 RTX Spark — nvidia · 2026-10-08
- 三周优化,vLLM 上 DeepSeek-V4.1-Flash 吞吐提升 5.3 倍 — vllm_project · 2026-10-08