实测 5 款开源模型对比 Claude,GLM 5.3 以 1/10 成本胜出
shensi · x · 2026-09-15
mergeapi 团队用 20 个真实编码任务,将 5 款开放权重模型与 Claude Sonnet 5 对比,包括 GLM 5.3、GLM 5.3 Flash、DeepSeek V4 Pro、DeepSeek V4 Flash 和 Kimi K3。结果显示 GLM 5.3 整体胜出,而成本仅为 Claude 的约十分之一。详细数据见原链接。
「编程与Agent」频道最新
- tldraw 设计冲刺新玩法:让 Codex 过夜把讨论点全部做成原型 — max__drake · 2026-09-15
- 研究 Agent 只记录引用还不够:被拒来源也应可审查 — Entire_Mark8010 · 2026-09-15
- 实测 Grok Bot 自动排期 Pinterest:配图写文一条龙 — prasenx · 2026-09-15
- Amplitude PR 量半年翻三倍,周期从 5.2 小时压到 44 分钟 — mobileraj · 2026-09-15
- 求推荐极简极速 CLI 编码 agent:嫌 Pi 启动慢 2 秒 — funbike · 2026-09-15
- LangChain 创始人谈 agent 记忆为何难落地:决定记什么才是硬骨头 — blaizedsouza · 2026-09-15