SSAD 2026 观察:VLA 换相机即失效,思维链与真实动机脱节

abursuc · x · 2026-09-18

SSAD 2026 会议上的又一组悲观结论:视觉-语言-动作模型(VLA)对新相机不具备泛化能力;其思维链(chain of thought)解释并不反映动作背后的真实内部原因。结合同串前文对扩散模型与公开数据集泛化性的质疑,整体指向具身智能当前技术路线的可靠性问题。

所属事件:SSAD 2026:端到端自动驾驶泛化与问责遭集中质疑(6 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →