VLM视觉Agent实现攀岩抓点检测与姿态可视化
jonstephens85 · x · 2026-08-26
开发者利用 @vlmrun 的视觉模型 Orion,通过提示词成功分割出所有蓝色的抱石抓点,结合人体姿态估计,可视化展示了手脚激活每个抓点的过程及躯干重心的移动路径。该工具旨在帮助攀岩者理解动作细节,展示了利用 VLM 直接进行目标分割而无需训练新数据集的高效工作流。
「多模态」频道最新
- MiniMax H3 生成 G.I. Joe 角色视频 — darthfurbyyoutube · 2026-08-26
- 实测显示:强 Critic 配合可大幅提升 gpt-image-2 效果 — andreisavu · 2026-08-26
- Hailuo AI 纺织纹理 Logo 动画提示词分享 — aziz4ai · 2026-08-26
- 视频生成模型 H3 惊现幽灵音频:提示词被朗读 — Vijayi · 2026-08-26
- Magnific 展示 T 台视频:高跟鞋节奏精准对齐音乐 — charis_ai · 2026-08-26
- Magnific 发布翼装飞行第一人称视频,沉浸感强 — charis_ai · 2026-08-26