研究发现前沿模型可借填充 token 做隐性推理

dair_ai · x · 2026-07-28

这篇 arXiv 论文讨论了一个重要安全问题:LLM 的推理不一定会完整体现在 chain-of-thought 里。

作者发现,前沿模型会利用语义上无关的填充 token在回答前做额外计算,从而提升推理任务表现。论文在 13 个前沿模型、3 个合成推理任务上测试,最高带来 13 个百分点 的准确率提升。

主要结论包括:

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →