开发者用 Liquid AI 600M 全模态决策模型,给救援人员摄像头做实时决策 demo
helloiamleonie · x · 2026-10-11
一位开发者出于好奇,尝试把「全模态决策模型」用在救援人员的 bodycam 或智能眼镜上,构建了一个快速 demo。选用 Liquid AI 刚开源的 d1-omni-600M(同时支持视觉与音频输入),用真实救援画面配合情境化提问,生成结构化决策。作者坦承 demo 还比较粗糙、存在幻觉,但小决策模型足够轻量、可直接跑在 bodycam 和智能眼镜等边缘设备上,是很有潜力的应用方向。背景:Liquid AI 同日发布了 Open d1 决策模型家族的两个开源权重模型(d1-3B 文本+视觉、d1-omni-600M 文本+图像或文本+音频),可从 Nvidia DGX 数据中心一路部署到 RTX 工作站和 Jetson 边缘设备。
「具身」频道最新
- 谷歌预热新品 Fitbit Edge 智能手环:曲面屏加 Gemini 智能追踪 — aziz4ai · 2026-10-11
- Unitree Dex5-S 灵巧手 22 自由度约 $6.5K,Digit 5 震动问题解析 — MarwaEldiwiny · 2026-10-11
- 前 SpaceX 工程师融资 1 亿美元造自动驾驶货运列车 — bennash · 2026-10-11
- 中国脑机接口进入快车道,辅助治疗与康复领域率先突破 — yogthos · 2026-10-11
- 用 ROS 2 复刻远程临场机器人:双向视频+自主导航+AI Agent 一体 — chrismatthieu · 2026-10-11
- 给机器人装上触觉:-flexi-tac 传感器让策略收敛更快、样本更省 — k7agar · 2026-10-11