Kimi K3 对决 GLM-5.3:编程任务平手但场景侧重不同
johnseach · x · 2026-08-22
Kimi K3 与 GLM-5.3 在编程任务上表现接近,综合评分持平,但适用场景差异显著。
GLM-5.3 (Zhipu)
- 基础与升级:基于约 750B 参数的 5.2 版本升级,仅通过后训练提升能力,暂不支持多模态。
- 性能与成本:支持 1M 上下文,速度快(80-93 t/s),价格维持不变(输入 $1.40/输出 $4.40)。
- 优势场景:在终端操作(Terminal-Bench 3.0 得分 28.3 vs K3 17.4)和代码安全方面表现更强,适合日常 Agent、脚本及 Python 流水线工作。
Kimi K3 (Moonshot)
- 基础与规格:2.8T 参数,支持图像和视频输入。
- 性能与成本:速度约 40 t/s,价格较高(输入 $3/输出 $15)。
- 优势场景:在部分软件工程基准(如 DeepSWE)中略胜一筹,且具备多模态能力。
「模型」频道最新
- 腾讯发布 UI-Mate-27B,支持桌面 GUI 智能体操作 — tencent · 2026-08-24
- Sakana AI 翻译模型日英评测超越 Google 与 DeepL — SakanaAILabs · 2026-08-24
- 不服 theo 的模型梯队榜,开发者 haider 自制一份自己的版本 — haider1 · 2026-08-24
- 神秘OxAlpha碾压Claude,阿里800亿港元押注AI — 创业邦 · 2026-08-24
- OpenAI谷歌掀大模型降价潮,智谱神秘模型碾压Claude — 创业邦 · 2026-08-24
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24