InferenceBench 更新:Claude Opus 5 登顶,推理加速达 8.9 倍
maksym_andr · x · 2026-08-13
InferenceBench 基准测试更新了最新前沿模型榜单,包括 Claude Opus 5、Sonnet 5、GPT-5.6 Sol Ultra、Kimi K2.7 Code 和 Grok 4.5。
其中 Claude Opus 5 以 8.90 倍的几何平均加速比登顶榜首,其表现是原始 PyTorch 基线的 8.9 倍。此外,引用推文指出,现在的模型已经开始能够根据具体的工作负载动态调整其服务策略。
「模型」频道最新
- 实测 Grok 4.6 修 Bug 能力:超越前代,成新默认模型 — PawelHuryn · 2026-08-13
- Grok 4.6在5美元预算下AI模型评测登顶,性价比突出 — XFreeze · 2026-08-13
- 长周期自主工作流:OpenAI 与 Anthropic 模型表现远超对手 — scaling01 · 2026-08-13
- Grok 4.6 智能体评测逼近 Claude Fable 5,单次任务成本仅其五分之一 — ArtificialAnlys · 2026-08-13
- DeepSeek V4 Pro 性价比曝光:单任务成本仅为 GLM5.2 十分之一 — ojasvi_yadav · 2026-08-13
- DeepSeek API 请求超时,疑似遭遇技术故障 — cedric_chee · 2026-08-13