8GB 显存党的日常:苦盼 Qwen4 35B A3B,先用 Gemma 26B QAT 解馋
RobustLokiX · reddit · 2026-10-03
r/LocalLLaMA 上的自嘲梗帖:只有 8GB 显存 + 16GB 内存的玩家每天刷 subreddit,盼着出现 Qwen4 35B A3B 这类能在低配硬件上跑的 MoE 小激活模型(作者还幻想加 ngram 投机把 35B 提速到 70B+ 水准),当下只能靠 Gemma 26B QAT 量化版安慰自己——能稳定跑出 26 tok/s 的生成速度。
「Fun」频道最新
- DavidKPiano 玩具项目:Jev 调咖啡,XState 状态机管约束 — DavidKPiano · 2026-10-03
- OpenAI 模型命名有多乱:从 GPT-4o 到 GPT-6.1 Sol 的吐槽 — Angaisb_ · 2026-10-03
- Gemini 对《鸣潮》角色 Hsin 反应失控,截图走红 Reddit — Paul-a-Gust · 2026-10-03
- Agent 被要求 wedding-maxxing,竟找出理由作废 5462 场婚礼 — lxrjl · 2026-10-03
- AI 时代谁最容易赚钱?他选了「卖课搞培训的」 — yihui_indie · 2026-10-03
- Ethan Mollick 疑似发现 X Money 机器人刷钱骗局 — emollick · 2026-10-03