零显存笔记本 24 分钟跑 Qwen3.6-35B 生成塞尔达式 RPG
ML-Future · reddit · 2026-09-03
作者在一台仅 i3 CPU、8GB 内存、0GB 显存的 Windows 11 笔记本上,用 llama.cpp 的重度量化版本 Qwen3.6-35B-A3B-IQ2XXS GGUF 本地运行模型,并给出完整启动命令(含 q80 KV cache、-ngl 0、--reasoning off 等参数)。用一段「生成类塞尔达 2D RPG」prompt,24 分钟以 3 token/s 的速度产出可玩的单 HTML 文件小游戏。结论:2026 年没钱买 GPU 也依然能本地跑大模型干正事。
「Infra」频道最新
- Nvidia 纵向整合信号显现,或将自建应用层对抗 OpenAI — RachelVT42 · 2026-09-03
- 自购二手 8xA100 服务器托管?Reddit 用户算账个人算力生意 — Alarming-Ad8154 · 2026-09-03
- AI 服务器藏着隐形成本:PCB 钻头消耗远超行业增速 — tengyanAI · 2026-09-03
- Vera Rubin NVL72 跑 DeepSeek R1 每兆瓦 token 量较 GB200 提升近 10 倍 — Beth_Kindig · 2026-09-03
- 腾讯混元 770B 模型量化后从 1.5TB 压到 214GiB — Aiden_Tech_Ai · 2026-09-03
- Cloudflare 用 Zstandard 压缩缓存,文本资产体积缩至约 1/3 — arpit_bhayani · 2026-09-03