ARC-2 数据显示智谱 GLM V4.1 或成当前最强中国模型
teortaxesTex · x · 2026-10-08
AI 评测观察者 teortaxesTex 基于从 Opus 手绘重建的 ARC-2 数据分析:由于 Zhipu 的 GLM V4.1 在注意力机制上成本更高且激活参数量与竞品相当,其性价比表现突出,他认为「就 ARC-2 而言,V4.1 是目前最好的中国模型」。他还表示正在游说 ARC 官方默认展示 token 用量,以提升榜单透明度。
所属事件:ARC-2 数据显示智谱 GLM V4.1 或为中国最强模型(2 条相关)→
「模型」频道最新
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08
- 三周冒出 113 个决策模型:七成基于 Qwen,最便宜的不到一厘钱 — jonathanmalkin · 2026-10-08
- 用户实测称 Haiku 5.5 是工作流重大升级 — Sorcerer12345 · 2026-10-08
- OpenRouter 上线决策模型排行榜,typesafeai 包揽全部类目第一 — gaganghotra_ · 2026-10-08
- OpenAI 推出 Intelligent UI,ChatGPT 可快速生成可交互界面作答 — gdb · 2026-10-08
- Claude Haiku 5.5 全线碾压 GPT-6 Luna,长上下文却贵 5 倍 — daniel_mac8 · 2026-10-08