LLM 常高估自己:答对了不代表收集够了信息

rohanpaul_ai · x · 2026-09-13

Rohan Paul 总结新论文《Do LLMs Know What to Ask and When? Evaluating Multi-Turn Information Seeking》(arXiv:2608.14808):LLM 经常低估自己需要收集多少信息就提前停止提问,因此应在其停止提问的时刻做评估,而不能只看最终答案准确率。一个正确答案可能掩盖糟糕的信息收集——模型可能靠先验知识或猜对,而并未收集足够证据。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →