对大模型粗鲁提问能省Token?研究称语气影响44%推理成本
rohanpaul_ai · x · 2026-08-03
宾夕法尼亚大学的一项最新研究发现,用户提问的语气会直接影响大语言模型(LLM)的输出成本与准确率。研究者在固定570道MMLU问题时,对多个模型测试了从讨好到威胁的7种语气。
结果显示,语气变化对准确率的影响最高不超过2.99%,但对输出Token用量的影响高达44.3%。不同模型对语气的反应各异:例如对 ChatGPT-4o 使用粗鲁语气能获得最高准确率(89.04%)且输出最短(平均223 tokens);而 Gemini 2.5 Flash Lite 在中性语气下表现最好,粗鲁语气反而导致准确率下降并增加35.2%的Token消耗。研究表明,语气不仅是用户体验问题,更是生产系统中需要标准化的成本与可靠性参数。
「模型」频道最新
- 实测百个Bug:如何将AI编程月费从200降至20美元 — PawelHuryn · 2026-08-03
- 非技术人员AI编程指南:20美元月费完胜200美元方案 — PawelHuryn · 2026-08-03
- LLM 掉入常识陷阱:显性数据致推理失效,最优模型也难幸免 — rohanpaul_ai · 2026-08-03
- 开发者用 GLM 5.2 辅助开发完整网页游戏 — ex-arman68 · 2026-08-03
- 曝 OpenAI Codex 内置 GPT-5.6 Luna Max,成本仅为 Sol 数分之一 — DeryaTR_ · 2026-08-03
- 实验证明现有大模型能力过剩,可复现 Astra 级效果 — danshipper · 2026-08-03