即时重推理与去插值让基线策略成功率从 76% 升到 88%
DominiqueCAPaul · x · 2026-08-04
- 作者表示,把 RTC 设成即时重新推理、并取消插值步骤后,一个 baseline policy 的成功率从 76% 提升到 88%。
- 这说明更直接的控制回路,可能比更平滑但更慢的中间步骤设计更有效。
- 代价是动作看起来非常“卡顿/生硬”,但实际效果却意外地不错。
- 由于原帖没有更多上下文,能确定的核心信息就是:这个控制策略改动显著提升了任务成功率。
「具身」频道最新
- Waymo:从 demo 到产品用了 15 年,如今每周 50 万单 — ycombinator · 2026-08-04
- H3 视频模型据称修复体操比例难题,还能做 3D 动作重建 — andrew_n_carr · 2026-08-04
- Gemini Robotics ER 2 开始自动标注 6.9 万条机器人视频 — DynamicWebPaige · 2026-08-04
- Waymo 联席 CEO:首个自动驾驶 demo 花了 18 个月,产品做了 15 年 — Y Combinator · 2026-08-04
- ScienceCorp 推出面向脑记录刺激的 Scifi 2 headstage — gottapatchemall · 2026-08-04
- FCC 拟禁新进口先进机器人,视频拆解政策细节 — carlosdponx · 2026-08-04