Qwen3.8-Max 在 FlashInfer 500 次测试中拿下第一
YouJiacheng · x · 2026-07-22
Qwen3.8-Max 登顶 FlashInfer 基准
配图里的排行榜显示,Qwen3.8-Max 在 SOL-ExecBench FlashInfer 上拿到 第 1。原帖补充,这个结果是基于 500 次运行、3 万次工具调用 的平均成绩,使用的是 Qwen3.8-Max-preview 搭配 Atrex Kernel Agent。
发帖人还称,这可能是除 GPT 和 Opus/Fable 之外,少数在生产级 kernel 优化能力上表现很强的前沿模型之一。
所属事件:阿里 Qwen3.8-Max 预览版登顶英伟达推理优化榜(3 条相关)→
「Infra」频道最新
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11