往机器人 VLA 模型里加希腊语:双语训练可提升性能但远逊英语
KIEFERSA · hf · 2026-09-09
这篇 HF 博客研究了机器人视觉-语言-动作(VLA)策略中的语言迁移问题。作者将指令机器翻译成希腊语,注入基于 Cosmos3 的 VLA 模型,以此度量多语言能力。
- 实验揭示了此类测量方法的多个陷阱(如翻译质量、指令覆盖差异会混淆结论)
- 结果显示:加入希腊语的双语训练相比单语基线带来性能提升,即双语数据对机器人策略有益
- 但希腊语性能仍远低于英语基线,说明 VLA 模型的语言能力高度偏向训练语言
对想做多语言机器人指令的研究者,这篇提供了度量方法论与正反两方面经验。
「具身」频道最新
- NVIDIA 开源 Alpamayo 2 Super 自动驾驶模型,9 月 9 日直播深潜 — PyTorch · 2026-09-09
- kornia-rs:Rust 低层 3D 视觉库,性能超 OpenCV 与 NVIDIA VPI — edgarriba · 2026-09-09
- ECCV 2026 工作坊论文:通过场景一致性约束改进 FoundationPose — ducha_aiki · 2026-09-09
- 让 agent 亲自动手建模拟器:通往机器人 AGI 的最快路径? — YouJiacheng · 2026-09-09
- 曝苹果 Watch 将配 Recaps:全天记录并 AI 总结你的对话与日常 — Scobleizer · 2026-09-09
- 清华曹婷发起域变换:具身智能比拼从堆数据转向部署后自进化 — 新智元 · 2026-09-09