第三方评测:Cloudflare clef 编码强但太贵,综合不及 Jev
airesearch12 · x · 2026-10-02
独立评测者公布对 Cloudflare clef 与 clef-flash 的评估结果,回答「Jev 能否被超越」:答案是基本不能。
- 两款模型都较强,在模型路由场景下甚至能超过原版 Jev;
- clef-flash 整体弱于 clef 和 Jev;
- clef 在编码和安全/Security 维度赢过 Jev,但其余维度持平或更弱;
- 最大问题是价格太贵:Capability Score 中 clef-flash 排第 12,clef 因成本过高被排除出 Jev 级别;Composite Score(含成本维度)中两者仅列第 25 和第 62。
评测者提供了可调参数的公开排行榜供实验。
「模型」频道最新
- Gemini 4 Argon 幻觉率 15%,居 AA-Omniscience 榜首 — import_jmr · 2026-10-02
- 用户实测 Opus 5.5:未见省 40% token,额度反而更快耗尽 — MarsupialFirst8617 · 2026-10-02
- llama.cpp 新增 Decision Models,本地推理迎来新玩法 — paf1138 · 2026-10-02
- 开发者试新模型 Argon:按 GPT 外部用法信任它跑,未见刷榜痕迹 — cgarciae88 · 2026-10-02
- NVIDIA 发布 Kumo-Tabular:面向结构化数据的表格基础模型 — nvidia · 2026-10-02
- Runware 上线 Claude Sonnet 5.5、Grok 4.7、GPT-6.1 Sol 三个新模型 — aziz4ai · 2026-10-02