Qwen3.8-Max 在 OpenRouter 得分骤降,作者怀疑 effort 参数未被正确传递
PawelHuryn · x · 2026-09-12
Pawel Huryn 发现 Qwen3.8-Max 的评分在不同渠道差异明显:OpenRouter 上 19 分,Alibaba 官方渠道 26 分。他怀疑原因是 OpenRouter 未正确提供 effort level 参数——他在过去也见过类似情况。目前已发起探针测试以确认,约 50 分钟后会把结果补充进线程。
「模型」频道最新
- 单张 RTX 5090 跑 502GB 模型:DeepSeek V4.1-Flash 展示本地 AI 新架构 — AccBalanced · 2026-09-12
- Codex 额度重置开始推送,GPT-Image 2.5 疑带新草图功能 — koltregaskes · 2026-09-12
- Orca 发布 DeepSeek V4.1 Flash 去审查 MLX 权重,面向安全研究 — AccBalanced · 2026-09-12
- 开源 33B 多模态模型 Agnes-3.0-Flash:混合注意力架构,262K 上下文 — Skyline34rGt · 2026-09-12
- 曝 DeepSeek V4.1 Flash 上线首日付费 token 超 3.1 万亿,稳定 230-300 TPS — AccBalanced · 2026-09-12
- OpenAI 用1万个Agent烧1.5亿美元攻克千禧年数学难题 — nordicinst · 2026-09-12