把 Jev 当机器人实时策略跑 MuJoCo,拆两次调用解决决策难题
facontidavide · x · 2026-09-19
开发者 @dimentary 测试了将 Jev 作为实时机器人策略运行于 MuJoCo 仿真环境。由于 Jev 起初表现挣扎,作者将每次更新拆成两次调用:先决定下一步做什么,再决定机械臂和夹爪如何移动。由于 Jev 不接受图像输入,作者把简化的几何信息和接触信息以文本形式喂给模型。这一「决策-执行」两段式拆分思路对类似的 VLM 控制机器人实验有参考价值。
「编程与Agent」频道最新
- willcb:上下文学习要胜任个人持续学习,得靠「怪异」神经符号 harness — willcb · 2026-09-19
- 在线RL才是当前真正可用的方案:从真实交互轨迹构建任务飞轮 — willcb · 2026-09-19
- 开发者实测:Codex 值 200 美元档,Claude 100 美元够用 — lxfater · 2026-09-19
- AgentSky 上线:浏览器免装调用 40+ 编码 Agent 可横向比价 — Aiden_Tech_Ai · 2026-09-19
- qwen-code SDK v0.1.13 发布:微压缩修复保住长会话提示词缓存 — github-actions[bot] · 2026-09-19
- 从脚本到推理模型:决策类任务正被拆出第三层架构 — arpit_bhayani · 2026-09-19