20 分钟讲透特斯拉 FSD:8 摄像头 36 帧,20 亿信息炼成两个输出
PTrubey · x · 2026-10-10
一支 20 分钟的解释视频系统拆解了特斯拉 FSD 端到端自动驾驶模型的训练原理:8 个摄像头以每秒 36 帧输入,约 20 亿条信息最终只输出两个数字——转向与加减速。
- 视频把特斯拉构建 FSD 的方法归纳为 14 个要素与一个飞轮,覆盖数据采集、影子模式、车队回传等闭环机制
- 作者称这是目前表现最强的「机器人超级智能」模型之一,适合想理解端到端视觉驱动范式如何被训练出来的观众
「具身」频道最新
- 上交大 UVTA 用 1000 条人类触觉示范教会机器人灵巧操作 — siyuanhuang95 · 2026-10-10
- SpaceX 星舰工厂瞄准年产 1000 艘,佛州 Gigabay 体量超现厂房 11 倍 — XFreeze · 2026-10-10
- 《铁甲钢拳》照进现实:人形机器人 Noisy Boy 对决 Raider-72 — zealcaiden · 2026-10-10
- Dyna 推出半人形机器人 Taku:为解决人类照看瓶颈 — JasonMa2020 · 2026-10-10
- 首场人形机器人死亡格斗赛实况,场面相当疯狂 — cixliv · 2026-10-10
- QWM 方法细节:形态编码器+自适应奖励归一化+潜在形态条件化 — breadli428 · 2026-10-10