AMD 7900 XT 跑 Gemma 模型掉速:131K 上下文成性能瓶颈
opoot_ · reddit · 2026-08-13
一位用户在 Windows 系统下使用 LM Studio 运行 Gemma 模型(131K 上下文,KV cache 量化),尽管显存足够,但生成速度异常缓慢(仅 14 TPS)。
该用户推测 Windows 系统环境可能是导致掉速的原因之一,并向社区寻求进一步的优化思路与解决方案。
「Infra」频道最新
- Menlo Park 电价高达 53.8 美分:自建 GPU 算力已不划算 — generativist · 2026-08-13
- 8GB显存跑图:RTX 3070 Ti本地实测Krea 2 Turbo — niechta · 2026-08-13
- Fluidstack 走访纽交所,探讨美国 AI 算力基建投资 — MxMnr · 2026-08-13
- 开源项目 mlx-dspark 让 Mac 跑大模型提速 3.3 倍 — A-Rahim · 2026-08-13
- 开源CUDA替代方案:实现AMD GPU代码跨平台移植 — tom_doerr · 2026-08-13
- 4GB 显存挑战:低端 PC 搭建本地开源智能体 — ComplexHuman26 · 2026-08-13