DeepSeek 新视觉模型接人形机器人,实测完成导航任务
zizhpan · x · 2026-08-22
DeepSeek 刚刚发布了 V4 Flash Vision 模型,该模型结合了 V4 Flash 的智能体/推理能力与视觉理解能力,基准测试显示其在多模态智能体任务上已接近 Anthropic Opus 4.8。
作者将此模型接入人形机器人“RalCox”,下达指令让其“安全接近正在使用笔记本电脑的人”。实验展示了机器人通过车载摄像头拍摄图像,发送给 DeepSeek 进行实时推理并执行任务的过程,终端截图显示了模型的推理链。
「具身」频道最新
- NVIDIA 推出 ADEPT:将灵巧度预训练,机器人新任务学习提速 3 倍 — KyleMorgenstein · 2026-08-22
- 诺奖得主 Szostak 谈 AI 机器人自演化 — danfaggella · 2026-08-22
- 定制人形机器人零部件供应商在中国,网友称美国制造难追 — TinfoilTricorn · 2026-08-22
- 两个 Ludi 智能体在演示日后互相对话 — Kangwook_Lee · 2026-08-22
- 工程师用无人机技术开发悬空雨伞 — mtizard · 2026-08-22
- 优必选机器人舞厅共舞,实时微调步伐 — rohanpaul_ai · 2026-08-22