RX 7900 XTX 本地跑 GPT-OSS-20B 比 R9700 快 30%
glenbeer · x · 2026-09-16
网友 1337hero 分享了重新把玩 RX 7900 XTX 的本地推理实测:理论上这些消费卡应快于 R9700,跑 GPT-OSS-20B 时确实快约 30%。但 Qwen3 8x27B(dense)的数字感觉不对劲,作者推测与它是稠密模型有关;而 Gemma4-26B-A4B 的 Q80 量化版速度表现亮眼。给想在 AMD 消费卡上本地部署 LLM 的玩家提供了参考数据。
「Infra」频道最新
- OpenAI 发布系列文章:ChatGPT 如何做到每秒 7000 万次请求 — AxSaucedo · 2026-09-16
- 英伟达开源 FlashDreams:给自回归视频与世界模型补上推理运行时 — techNmak · 2026-09-16
- SK 海力士与英特尔据悉洽商在美国生产存储芯片 — zephyr_z9 · 2026-09-16
- AI 热潮推升日本芯片出口,8 月出口再度增长 — PAstynome · 2026-09-16
- 开发者用 GPT-6 重写 Radish:在 Durable Object 里跑 Redis — whoiskatrin · 2026-09-16
- Anthropic 落地首个澳洲数据中心,昆士兰项目估值达 319 亿美元 — nordicinst · 2026-09-16