OpenRouter 被曝静默吞掉推理参数,模型实测成绩大幅失真

PawelHuryn · x · 2026-08-07

开发者 Pawel Huryn 在测试 Meta Muse Spark 1.2 模型时发现,通过不同 API 路由调用同一模型,在 105 个 Bug 的基准测试中得分出现了差异(14 分 vs 17 分)。

排查后发现,OpenRouter 会静默吞掉 reasoningeffort 参数。如果向各家官方 API(如 Meta、xAI)发送无效的参数值,会正常返回 400 报错;但向 OpenRouter 发送时,它会返回 200 成功,却完全不应用该参数。这意味着在 OpenRouter 上调用 Kimi K3 和 DeepSeek 等模型时,请求中填写的 high 实际上都被降级成了 default。

最后,作者基于实测更新了自己的模型路由表:日常判断用 Fable,重度编码用 Sol,日常任务子智能体用 Grok,追求性价比则用 Luna + max effort。

所属事件:OpenRouter被曝未正确传递推理参数致模型成绩失真(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →