Kimi K3 评测达 88/98,Qwen3.8-Max 实力超分数
Correct_Tomato1871 · reddit · 2026-08-09
Reddit 网友分享了最新的大模型基准测试笔记,对比了 Kimi K3、Qwen3.8-Max 和 Gemini 3.6 Flash 的表现。
核心结论包括:Kimi K3 拿到了 88/98 的高分;Qwen3.8-Max 的实际能力比其表面得分所反映的更强;而 Gemini 3.6 Flash 相比前代 3.5 版本出现了性能下滑。
「模型」频道最新
- 今日AI圈速览:DeepSeek周末半价、GPT-5.6 Sol降价、阿里配售800亿投AI — APPSO · 2026-08-24
- 隐身模型 Ox Alpha 登场 Context Arena,匹配 GPT-5.6 — scaling01 · 2026-08-24
- Fable 5 仅占 6% 销量,Anthropic 遭遇降本冲击 — rohanpaul_ai · 2026-08-24
- Opus 5 说话像法庭剧?如何调教掉废话 — thk_ · 2026-08-24
- 2026 年中国模型全景:DeepSeek V4、Kimi K3 等在列 — TheTuringPost · 2026-08-24
- 传闻 Claude Opus 6 泄露:上下文 250 万,推理更强 — iamaliveix · 2026-08-24