OpenRouter 被曝静默吞掉推理参数,模型实测成绩大幅失真
PawelHuryn · x · 2026-08-07
开发者 Pawel Huryn 在测试 Meta Muse Spark 1.2 模型时发现,通过不同 API 路由调用同一模型,在 105 个 Bug 的基准测试中得分出现了差异(14 分 vs 17 分)。
排查后发现,OpenRouter 会静默吞掉 reasoningeffort 参数。如果向各家官方 API(如 Meta、xAI)发送无效的参数值,会正常返回 400 报错;但向 OpenRouter 发送时,它会返回 200 成功,却完全不应用该参数。这意味着在 OpenRouter 上调用 Kimi K3 和 DeepSeek 等模型时,请求中填写的 high 实际上都被降级成了 default。
最后,作者基于实测更新了自己的模型路由表:日常判断用 Fable,重度编码用 Sol,日常任务子智能体用 Grok,追求性价比则用 Luna + max effort。
所属事件:OpenRouter被曝未正确传递推理参数致模型成绩失真(2 条相关)→
「编程与Agent」频道最新
- 实用 Hermes 提示词技巧:让 Agent 自查代码变更 — alexcovo_eth · 2026-08-07
- 为 Prime Agent 开发交互与浏览器控制插件 — daniel_mac8 · 2026-08-07
- 探讨 AI 主动发起任务:基于对话上下文自动生成子智能体 — thisiskp_ · 2026-08-07
- Malwoverview:支持 LLM 提取 IOC 的恶意软件狩猎工具 — tom_doerr · 2026-08-07
- 开发者给 Claude 90 美元与独立域名,AI 自主构建区块链付费问答产品 — No_Departure_9908 · 2026-08-07
- 60秒为云端AI Agent配置真实Mac与Xcode环境 — smtabatabaie · 2026-08-07