FreeToken 助力本地 AI,8G 显存笔记本可跑 35B 模型
mark_k · x · 2026-08-23
FreeToken 是一项针对本地 AI 的软件突破,通过智能协调 GPU、CPU 和系统 RAM,动态迁移 MoE 专家模型,打破了必须依靠足够显存加载整模型的限制。
实测显示,搭载 8GB RTX 4060 的普通笔记本能以 39 tok/s 运行 35B 模型;配备 RTX 5090 的游戏 PC 可交互式运行巨大的 284B DeepSeek 模型。这意味着用户无需 API 付费或依赖云端,即可在现有硬件上运行更强大的 AI。
所属事件:伯克利MIT开源FreeToken:消费级PC本地跑前沿MoE大模型(11 条相关)→
「Infra」频道最新
- 优化被动 Oculink 设置意外实现 CUDA 调度器 — TinFoilHat_69 · 2026-08-29
- RX 9070 XT 运行 ComfyUI 速度波动巨大 — bosox62 · 2026-08-29
- 开源 LLM 推理静态性能模型,支持多种缓存策略 — stanfordnlp · 2026-08-29
- 预测闭源前沿模型 2027 前变下载版,英伟达豪赌开源 — imjustnewatai · 2026-08-29
- 实测 Qwen3.8 在双节点 DGX 上达 181 tok/s 吞吐 — StartupTim · 2026-08-29
- Together 平台 24 小时处理 GLM-5.3 Flash 超 1350 亿 token — togethercompute · 2026-08-29