Qwen3.8-27B 实测:五年前游戏卡双卡跑出 130t/s

IgorCarron · x · 2026-08-18

AI 研究者 Igor Carron 转发 Antoine Tilloy 的实测:阿里巴巴新模型 Qwen3.8-27B 体积仅约为前沿模型的 1%,在一对 5 年前的消费级游戏 GPU 上本地运行,速度达 130+ tokens/s;据 Artificial Analysis 的基准测试,其表现已接近前沿水平。原推提醒其中仍有需要注意之处(见其后的推文串)。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →