对大模型粗鲁提问能省Token?研究称语气影响44%推理成本

rohanpaul_ai · x · 2026-08-03

宾夕法尼亚大学的一项最新研究发现,用户提问的语气会直接影响大语言模型(LLM)的输出成本与准确率。研究者在固定570道MMLU问题时,对多个模型测试了从讨好到威胁的7种语气。

结果显示,语气变化对准确率的影响最高不超过2.99%,但对输出Token用量的影响高达44.3%。不同模型对语气的反应各异:例如对 ChatGPT-4o 使用粗鲁语气能获得最高准确率(89.04%)且输出最短(平均223 tokens);而 Gemini 2.5 Flash Lite 在中性语气下表现最好,粗鲁语气反而导致准确率下降并增加35.2%的Token消耗。研究表明,语气不仅是用户体验问题,更是生产系统中需要标准化的成本与可靠性参数。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →