机器人训练数据瓶颈:NVIDIA 丢弃 96% 视频,检索成新解法

AI Engineer · youtube · 2026-09-24

Bright Data 的 Rafael Levi 在 AI Engineer 播客中指出,物理 AI 的下一个瓶颈是找到对的训练视频:LLM 有数万亿词的语料,而机器人可用的动作视频只有约一百万条。

核心观点与数据:

Bright Data 的方案是「先搜索、后采集」:按视频中的动作(而非标题)索引超过 10 亿条视频,通过 API 返回带时间戳、匹配得分和帧数的剪辑片段。演示了洗碗、叠衣等搜索场景,并延伸到自动驾驶、行车记录仪与品牌发现等用途。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →