开发者发现 GPT-OSS-120B 一直跑在 medium 推理档,调到 high 质量大涨

userpostingcontent · reddit · 2026-09-24

独立开发者复盘其事实核查产品 PopUpFactCheck 的一次「质量突破」:过去几个月的调优中,主力模型 GPT-OSS-120B 一直运行在 OpenRouter 的 medium 推理努力档而非 high。切到 high 后,模型在最关键的归因、证据核对与判断任务上表现显著提升。

由于架构上用 FAISS 与 DynamoDB 激进缓存已完成的核查结果,并将推理路由到最低成本供应商,新增推理成本可以消化,该改进已上线生产。

另一个可借鉴的点:很多人调 prompt 找质量问题时,先检查推理档位/参数这类底层配置。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →