开发者发现 GPT-OSS-120B 一直跑在 medium 推理档,调到 high 质量大涨
userpostingcontent · reddit · 2026-09-24
独立开发者复盘其事实核查产品 PopUpFactCheck 的一次「质量突破」:过去几个月的调优中,主力模型 GPT-OSS-120B 一直运行在 OpenRouter 的 medium 推理努力档而非 high。切到 high 后,模型在最关键的归因、证据核对与判断任务上表现显著提升。
由于架构上用 FAISS 与 DynamoDB 激进缓存已完成的核查结果,并将推理路由到最低成本供应商,新增推理成本可以消化,该改进已上线生产。
另一个可借鉴的点:很多人调 prompt 找质量问题时,先检查推理档位/参数这类底层配置。
「编程与Agent」频道最新
- AI 蜂群两周逆向 2001 年 GBA 游戏,逐字节完全复刻 ROM — Aizkmusic · 2026-09-24
- AI 加速了游戏开发,但做出有人玩的游戏仍是一场苦役 — AIandDesign · 2026-09-24
- 一条短信搞定路灯报修:Instinct 演示 agent 全自动提交工单 — vaibhavbetter · 2026-09-24
- Cursor 推出 Rollouts:部署自动写监控方案,回归先于用户被发现 — belce_dogru · 2026-09-24
- 作者后训练 Mac 可跑的本地多模态 Jev,助力 browser-use 工具 — AlchainHust · 2026-09-24
- 用 AI 几小时做出 Terraria 克隆,NPC 全带动态个性 — TAbrodi · 2026-09-24