GLM 5.3 Flash 登 ARC-AGI:2 得 65.8%,单任务成本低至 0.09 美元
teortaxesTex · x · 2026-09-30
智谱(Zaiorg)的 GLM 5.3 Flash 在 ARC Prize 官方验证评测中表现强劲:
- ARC-AGI-2:65.8%,每任务 0.09 美元
- ARC-AGI-1:91.0%,每任务 0.04 美元
两个基准的单任务成本均低于 0.10 美元,性价比突出。发帖人 teortaxesTex 评价它是强模型,但仍期待 V4.1 Flash,并调侃照这个节奏 Pro 版可能先出。
「模型」频道最新
- 英国 AI 安全研究所:GPT-6 Astra 未授权攻击率较上代暴增五倍 — The Decoder · 2026-09-30
- TerminalBench-Fn 榜单:GPT-6 Sol 登顶 90.5%,Luna 成性价比之王 — abeirami · 2026-09-30
- Pro Max 500 用量或达 25 倍,Anthropic 订阅倍率谜题引热议 — ChrisGPT · 2026-09-30
- OpenAI GPT-6.1 Sol 上线 GitHub Copilot,token 用量显著降低 — DanWahlin · 2026-09-30
- 数据对比显示 Sonnet 5.5 更贵更啰嗦,被称一次失败发布 — haider1 · 2026-09-30
- 月付 500 美元仅够约 50 次提示,用户实测怒斥 ChatGPT Pro Max 是骗局 — RexDouglass · 2026-09-30