Claude Opus 5 称霸 KernelBench,暗示内部模型更强
scaling01 · x · 2026-08-16
scaling01 发推称 Claude Opus 5 在 KernelBench 基准测试中表现优异,并暗示其内部模型(Model 2)能力更强。
所属事件:Claude Opus 5 领跑 KernelBench 基准测试(2 条相关)→
「模型」频道最新
- Qwen3.8量化实验:哪些权重组最关键?KLD测试揭示意外发现 — enginetown · 2026-08-16
- 视觉模型仍无法识别视错觉,迷你 AGI 基准曝光 — legit_api · 2026-08-16
- 0831 版本较 Preview 有实质性提升 — jeff_weinstein · 2026-08-16
- 讨论上下文激活权重与 MoE 机制误区 — teortaxesTex · 2026-08-16
- H3 模型结合 LoRA 的正确工作流是什么? — james25679 · 2026-08-16
- 评 Kimi 等国产模型评测过拟合:认知能力被掩盖 — teortaxesTex · 2026-08-16