Jev 对弈 GLM 5.3:29 步被将死,但每步仅 0.3 秒、成本低 80 倍
nutlope · x · 2026-09-19
作者让专用小模型 Jev 与 GLM 5.3 下国际象棋做对比:GLM 5.3 在第 29 步将死获胜;Jev 每步约 0.3 秒、成本低于 0.0001 美元,GLM 5.3 每步约 5.8 秒、约 0.008 美元,整局总花费 24 美分。
结论是应按各自强项分工:
- 快速、定义明确的分类 → Jev 这类专用模型
- 需要推理或前瞻的分类 → GLM 5.3 这类 LLM
- 真实分类流水线 → 混合方案,Jev 处理简单调用,开源模型处理困难样本
作者认为未来是多模型协作。
「编程与Agent」频道最新
- OpenWA:14k 星开源 WhatsApp API 网关,自托管多会话管理 — tom_doerr · 2026-09-19
- 开源电脑操作模型 CUA-S1 发布,首个表单专精模型可自用 — ycombinator · 2026-09-19
- 单条 prompt 生成 3D 平台游戏:Astra 编排 Thrixel 管线产出可编辑素材 — RanaHanocka · 2026-09-19
- OpenDDE 将结构预测与蛋白质设计插件带入 Codex 和 Claude Code — AllThingsApx · 2026-09-19
- 长文辨析世界模型:Agent 需要的不是 RAG 而是状态追踪 — techNmak · 2026-09-19
- 176 组实验拆解 Coding Agent Harness:上下文管理弱模型时最关键 — _akhaliq · 2026-09-19