研究证实:让 LLM 输出精简真能省钱
ibubbles34 · reddit · 2026-08-22
研究测试了在 9 个模型上压缩输入 Prompt 与要求模型输出精简两种策略的效果。结果显示:
- 压缩输出:平均节省约 1.5 倍成本,最高达 3 倍,且准确率基本保持不变,多语言测试也有效。
- 压缩输入:适得其反,成本最高增加 96%,因为模型会通过增加输出长度来弥补信息缺失,且准确率下降。
- 研究建议直接通过 API 提示词控制输出长度来省钱,因为输出 Token 通常比输入 Token 更贵。
「研究」频道最新
- Equilibrium Forcing:无需噪声条件的自适应视频生成 — kwangmoo_yi · 2026-08-22
- 新方法 Equilibrium Forcing 实现视频生成的自适应噪声估计 — kwangmoo_yi · 2026-08-22
- 深度播客:世界模型如何解锁物理 AI 与机器人技术 — risingodegua · 2026-08-22
- OpenBind 发布:基于 OpenFold3 的小分子共折叠模型 — MoAlQuraishi · 2026-08-22
- 新研究用 LLM 代码生成驱动进化算法,自创专家 API — kenneth0stanley · 2026-08-22
- Yukon 排行榜更新:改按总贡献速度比排名 — morgymcg · 2026-08-22