HyperQwen 项目招募 4090/5090 用户优化 Qwen 本地推理速度

iamMess · reddit · 2026-09-18

Reddit 用户 iamMess 宣布将其针对 RTX 3090 的 Qwen 推理优化项目更名为 HyperQwen,从单一显卡/单模型扩展到面向多种 Qwen 模型和本地硬件。

作者招募拥有 4090、5090(单卡或多卡均可)的 Windows 和 Linux 用户帮忙测试,目标是追求最大 decode 和 prefill 速度;鉴于 Qwen4 即将发布,该仓库有望成为获取极限推理速度的参考。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →