ELLISS 自动驾驶暑期学校:自动驾驶强化学习两讲讲义上线
abursuc · x · 2026-09-15
Maximilian Igl 在 ELLIS 巴塞罗那自动驾驶暑期学校做了两部分关于自动驾驶强化学习的讲座,讲义已在线公开(交互式 Reveal.js 幻灯片)。
- 第一部分:RL 基础 —— 为什么需要 RL(协变量偏移及实验证据)、从第一性原理讲到 PPO 与 GRPO(含价值函数与 GAE 简介),以及探索等更广的 RL 图景。
- 第二部分:RL 用于自动驾驶的研究前沿。
「研究」频道最新
- 实测发现次正规浮点数拖慢性能的问题几乎仅存在于 Intel 处理器 — lemire · 2026-09-15
- Adaption AI 推出 Invent API:几行代码生成可商用训练数据集 — sarahookr · 2026-09-15
- 港理工发布以人为中心的智能综述:六层递进框架统一碎片化研究 — jiqizhixin · 2026-09-15
- arXiv 新论文提出 k-鲁棒联盟对齐:弱化条件下的 agent 安全授权 — Aaroth · 2026-09-15
- Arvind Rajeswaran 提出「联盟对齐」弱条件可保证多智能体安全 — Aaroth · 2026-09-15
- 联盟对齐扩展到长时程 MDP:Nash 均衡全部安全 — Aaroth · 2026-09-15