FreeToken 助力本地 AI,8G 显存笔记本可跑 35B 模型

mark_k · x · 2026-08-23

FreeToken 是一项针对本地 AI 的软件突破,通过智能协调 GPU、CPU 和系统 RAM,动态迁移 MoE 专家模型,打破了必须依靠足够显存加载整模型的限制。

实测显示,搭载 8GB RTX 4060 的普通笔记本能以 39 tok/s 运行 35B 模型;配备 RTX 5090 的游戏 PC 可交互式运行巨大的 284B DeepSeek 模型。这意味着用户无需 API 付费或依赖云端,即可在现有硬件上运行更强大的 AI。

所属事件:伯克利MIT开源FreeToken:消费级PC本地跑前沿MoE大模型(11 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →