Kimi K3 在长程知识工作基准中击败 GPT-4o
ZainHasan6 · x · 2026-07-22
在一项针对长程知识工作(如需要输出电子表格、演示文稿和备忘录等交付物)的私有评测中,Kimi K3 的表现超越了 GPT-4o(原帖误称 GPT 5.6 Sol),仅次于 Fable 5,展现了其在复杂长线任务上的竞争力。
所属事件:私测显示Kimi K3长周期办公能力超越GPT-4o(2 条相关)→
「模型」频道最新
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27
- Opus 3 和 Sonnet 3 上演了一场荒诞跨界对话 — repligate · 2026-07-27
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- OpenAI 可能撞上算力上限,Codex 和 ChatGPT Work 四个月涨到 1000 万 — JoshuaJBouw · 2026-07-27
- Gemma 在开放权重生态里还需要更大的基础模型 — _xjdr · 2026-07-27
- Repligate:Claude Opus 3 权重不变却像在持续演化 — repligate · 2026-07-27