Kimi-K3 跑出 60.4% 成绩,登顶 ARC-AGI-2
scaling01 · x · 2026-08-01
Kimi 最新模型 Kimi-K3 在 ARC-AGI-2 基准测试中取得了 60.4% 的高分,展现了极强的抽象推理能力。
「模型」频道最新
- Gemini 因缺失视觉能力,竟尝试用代码自建「像素法医」 — teortaxesTex · 2026-08-01
- 行业探讨:300B 参数的 V4 Pro 能否击败 2.8T 新模型 — scaling01 · 2026-08-01
- DeepSeek V4 Flash 免费级别,Luna Max 大降价性价比惊人 — Hesamation · 2026-08-01
- ChatGPT Pro 订阅用户反馈:额度无故暴增 40% — mad_qubik · 2026-08-01
- 极速大模型重塑编码:Opus 4.5 与 Qwen3 Coder 实测体验 — dbreunig · 2026-08-01
- TracerML 发布开源模型 Echo:性能比肩 Fable,推理成本仅三分之一 — ycombinator · 2026-08-01