大模型新赛季:Kimi K3领跑,智谱GLM5.3续命,国产模型混战
葬AI · wechat · 2026-08-17
公众号文章深度分析2026年上半年中国大模型竞争格局。作者认为公开benchmark已无意义,模型厂可跑出任何想要的成绩,真实场景表现才是关键。新赛季分两个阶段:上半年猛攻编程场景,智谱GLM5.2率先斩杀Opus4.8;下半年参数量大跃进,Kimi K3以2T参数率先开启新赛季,跑分逼近Fable5,并凭借前端生成能力打穿场景。Qwen3.8Max(2.4T)紧随其后,但多模态能力弱。DeepSeek V4 Pro表现不稳定,官方bench与实测偏差大。Grok4.6性价比高,马斯克预告Grok4.7(2.1T)将发布。作者还提到GLM5.3更新,但提升有限,执行任务偏慢。最后总结Kimi是版本之子,其他厂商需在2T参数级证明自己。
「公司和人」频道最新
- Sakana AI 招聘 LLM 开发工程师,负责全流程 — hardmaru · 2026-08-24
- a16z 合伙人盛赞新模型:或为今年最重要发布 — daniel_mac8 · 2026-08-24
- 多数企业 AI 采用速度远超预期 — nikvassev · 2026-08-24
- 神秘OxAlpha碾压Claude,阿里800亿港元押注AI — 创业邦 · 2026-08-24
- 网友愿放弃一切加入的公司名单:SpaceXAI 榜首 — JosephJacks_ · 2026-08-24
- 16 岁高中生在校成立 AI 社团,免费共享算力 — 数字生命卡兹克 · 2026-08-24