Liquid AI 开源 d1 决策模型家族:600M 就能跑文本视觉音频
JosephJacks_ · x · 2026-10-08
Liquid AI 发布开源权重决策模型家族 Open d1 的两款多模态模型:d1-3B(文本+视觉)表现扎实,d1-omni-600M(600M 参数)支持文本、视觉与音频输入。定位「大多数决策不需要大模型,只需要快模型」,可从 NVIDIA DGX 数据中心、RTX 工作站一路部署到边缘端 Jetson,实现实时决策。官方还上线了带互动小游戏的 Hugging Face Space 供体验。
所属事件:Liquid AI 开源 d1 决策模型:3B 与 600M 双多模态(7 条相关)→
「多模态」频道最新
- Midjourney 上线 10 月 7 日 Office Hours 视频回放 — midjourney · 2026-10-08
- 本地 3B 音乐模型写歌,Claude 一条 prompt 生成音乐 MV — Pleasant_Salt6810 · 2026-10-08
- Runway 视频生成进驻 ChatGPT:对话窗口内直达简报、生成、改稿 — runwayml · 2026-10-08
- 280次生成磨出超人vs埼玉预告片:MiniMax H3实战经验全公开 — Automatic-Building84 · 2026-10-08
- Gossip Goblin 被赞 AI 艺术未来样板:短剧惊艳还发布了电影预告 — PossibleVariety7927 · 2026-10-08
- Epoch 报告:Q1 上线 12.8 万部微短剧,95% 以上由 AI 生成 — Jsevillamol · 2026-10-08