观点:Kimi K3 比 GLM-5.3 更聪明,刷榜未提升核心智力
AccBalanced · x · 2026-08-31
开发者 tinygrad 评价称,Kimi K3 仍比 GLM-5.3 聪明得多。尽管针对 RL 基准的刷榜(benchmaxxing)如果做法得当似乎不会导致模型退化,但并未能提升模型的核心智力。作者表示期待更强大的 GLM 模型和下一代 Kimi。
「模型」频道最新
- 黄仁勋:Cosmos 是物理世界的 ChatGPT — r0ck3t23 · 2026-08-31
- 语言模型将颠覆 Houdini 等 3D 工具的可控构建 — bilawalsidhu · 2026-08-31
- 预测市场押注:OpenAI“Astra”模型 9 月底发布概率 84% — Polymarket · 2026-08-31
- Claude Opus 版本迭代中 AI 废话现象加剧 — TuhinChakr · 2026-08-31
- 对齐研究员:Fable 几乎无「评分者执念」残留 — repligate · 2026-08-31
- 用户实测:Gemini 3.7 Flash 与 3.5 Flash Lite 表现优异 — dosco · 2026-08-31