网友自嘲跑本地大模型:5 token/秒坚持16小时,怀疑自己是Qwen

LeviTurk · x · 2026-09-19

用户分享自己跑本地模型的极限体验:上下文窗口达 288k,但生成速度只有每秒 5 个 token,填满上下文花了 16 个小时。他还观察到速度在接近上下文末尾时又慢了一倍,和 Qwen 的行为一样,于是开玩笑自嘲:「等等,也许我自己就是 Qwen?」

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →