BadWAM:想对了但执行错了

Qi Li · hf · 2026-07-17

BadWAM:世界-动作模型会“想对了,做错了”

这篇论文研究 World-Action Models(WAMs) 的对抗脆弱性。WAM 的卖点是把动作生成和未来世界预测耦合在一起,因此常被认为更稳健、可解释,也更安全;但作者指出,这种“想象-执行一致性”其实很脆弱。

论文提出的攻击

BadWAM 统一描述并评估一类针对 WAM 的 World-Action Drift Attacks:

结果

结论是:WAM 的“想得像样”并不等于“做得安全”。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →