SSAD 2026 观察:VLA 换相机即失效,思维链与真实动机脱节
abursuc · x · 2026-09-18
SSAD 2026 会议上的又一组悲观结论:视觉-语言-动作模型(VLA)对新相机不具备泛化能力;其思维链(chain of thought)解释并不反映动作背后的真实内部原因。结合同串前文对扩散模型与公开数据集泛化性的质疑,整体指向具身智能当前技术路线的可靠性问题。
所属事件:SSAD 2026:端到端自动驾驶泛化与问责遭集中质疑(6 条相关)→
「具身」频道最新
- Notmisha 谈机器人训练:模仿学习在岗有效,短板在预训练 — notmisha · 2026-09-18
- Microduck 机器人鸭头设计迭代过程曝光 — Sentdex · 2026-09-18
- 特斯拉澳洲数据:FSD 自动驾驶碰撞率比人工驾驶低 40% — elonmusk · 2026-09-18
- KRAFTON AI 办 Autonomy 黑客松,冠军奖金千万韩元并免技术面 — Kangwook_Lee · 2026-09-18
- 用 ESP32-S3 自制桌面额小屏,实时显示 Claude 与 Codex 用量 — nurikodd · 2026-09-18
- 夏校现场逐家拆解自动驾驶 SOTA 方案:花活多但都不泛化 — ftm_guney · 2026-09-18