Glean 公开模型路由评分:GPT-5.6 性能第一仅 8 美分
testingcatalog · x · 2026-08-27
Glean 公布了其模型路由系统的评分数据,显示了不同前沿模型在特定任务下的表现与成本对比:
- GPT-5.6 Luna:评分 55,成本 $0.08/任务
- GLM 5.2:评分 57,成本 $0.35
- Gemini 3.7 Flash:评分 61,成本 $0.47
- Kimi K3:评分 63,成本 $0.90
- Claude Opus 5:评分 67,成本 $2.96
Glean 使用名为 Waldo 的小型专家模型(基于 NVIDIA Nemotron 3 Nano 微调)在运行时动态确定所需的推理级别,并在必要时将任务切换到专家模型。该系统覆盖了 40 多个开源和前沿模型,并支持“努力路由”来控制模型的思考强度。
「Infra」频道最新
- ComfyUI 推出 INT6 量化节点,显存占用降 25% — BakaPotatoLord · 2026-08-27
- 芯片制裁反噬?SemiAnalysis称免费token达100T/天 — basedjensen · 2026-08-27
- Foresight 研究所撰文:开放科学需要开放算力,目前算力垄断阻碍独立研究 — niloofar_mire · 2026-08-27
- 实测 Minimax H3 显存占用:8GB 显卡即可跑 1376x768 视频 — Zironic · 2026-08-27
- Google 公布 9600 芯片 TPU 8t,OpenAI 透露三代芯片路标 — SumitGup · 2026-08-27
- 4090 显卡推理优化实战:延迟降至 10ms 以下 — yacineMTB · 2026-08-27