NYU 提出 CIA 指标:LLM 思维链仅 44.8%-75.9% 反映内部计算

newyorkuniversity · hf · 2026-10-07

纽约大学团队研究 LLM 的思维链(CoT)与其实际内部计算的对齐问题。已有证据表明模型 CoT 常不能反映内部计算,且可被改写而不影响最终答案。

核心贡献

该工作为审计 CoT 忠实性提供框架,也给出让模型显式推理更可信的路径。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →