SegDAC:用动态对象令牌提升视觉 RL 泛化性
GlenBerseth · x · 2026-08-18
SegDAC 是一种在视觉强化学习(RL)中利用预训练分割模型的新方法。它不再基于像素,而是通过文本引导的分割生成对象掩码,提取一组可变长度的动态对象令牌。基于 Transformer 的 Actor-Critic 处理这些令牌,并使用片段位置编码保留空间信息。在 ManiSkill3 的 8 个操作任务上,SegDAC 在最难的视觉扰动设置下比之前的方法提升了 88% 的泛化性能,同时保持了最先进视觉 RL 方法的样本效率。相关代码已开源。
「研究」频道最新
- Anthropic 发布多智能体系统失效模式研究,警示系统性风险 — thione · 2026-08-18
- 技术圈热议LLM词表瓶颈:缩小词表能否解决问题? — LChoshen · 2026-08-18
- 新研究:LLM 智能体能预估任务耗时吗? — maksym_andr · 2026-08-18
- AI 色情社区治理与审核难题研究 — chaumian · 2026-08-18
- Dyna Robotics 复盘:百万小时第一视角视频训练机器人,基础设施全面失效 — ZeYanjie · 2026-08-18
- 详解开源 MoE RL 零偏差训练:原理与消融实验 — PandaAshwinee · 2026-08-18