开发者用 Liquid AI 600M 全模态决策模型,给救援人员摄像头做实时决策 demo

helloiamleonie · x · 2026-10-11

一位开发者出于好奇,尝试把「全模态决策模型」用在救援人员的 bodycam 或智能眼镜上,构建了一个快速 demo。选用 Liquid AI 刚开源的 d1-omni-600M(同时支持视觉与音频输入),用真实救援画面配合情境化提问,生成结构化决策。作者坦承 demo 还比较粗糙、存在幻觉,但小决策模型足够轻量、可直接跑在 bodycam 和智能眼镜等边缘设备上,是很有潜力的应用方向。背景:Liquid AI 同日发布了 Open d1 决策模型家族的两个开源权重模型(d1-3B 文本+视觉、d1-omni-600M 文本+图像或文本+音频),可从 Nvidia DGX 数据中心一路部署到 RTX 工作站和 Jetson 边缘设备。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →