18 个 VLM 实证:CoT 推理中模型固守初始答案难自我纠错

delliott · x · 2026-10-06

哥本哈根大学团队(论文作者 Danae Sánchez Villegas、Desmond Elliott 等)在 COLM 2026 发表论文,分析 18 个视觉语言模型的推理动态,覆盖指令微调与推理训练两类、两个模型家族。

核心发现:

论文对「通过 CoT 监控模型是否依赖正确模态」这一安全监控思路给出了能力边界。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →