Kimi 全栈编程评测登顶,超越 Anthropic 与 OpenAI 主力模型
airesearch12 · x · 2026-08-01
最新数据显示,在 Fullstack Code Arena 全栈编程竞技场中,Kimi 的模型得分已经超越了 Anthropic 和 OpenAI 的多款主力模型,暂列第一。而被引用的榜单详情显示,OpenAI 的 GPT-5.6 Sol 以 1638 分位列全栈榜单第三,Terra 和 Luna 则分列第十和第十四。此外,Anthropic 的 Opus 5 (Max) 也即将加入该榜单。
「模型」频道最新
- Kimi K3 模型已上线 OpenRouter,官方探讨推出快速版 — AAAzzam · 2026-08-01
- antirez 发布 DeepSeek V4 Flash 多款 GGUF 量化文件,含 2bit 至 4bit 版本 — antirez · 2026-08-01
- 讨论:大模型过度刷榜(Benchmaxxing)如何导致实际任务不可用 — Witty_Mycologist_995 · 2026-08-01
- 实测大模型超长上下文:30万 token 后智商骤降 — teortaxesTex · 2026-08-01
- Moonshot 2.8 万亿参数 Kimi K3 上线微软 Azure AI Foundry — ccerrato147 · 2026-08-01
- Fable 模型展现惊人隐性知识,用专业物理词汇劝退用户 — voooooogel · 2026-08-01