8-16GB 显存新思路:通用模型编排多个领域专家小模型

CyberExplore · reddit · 2026-10-06

发帖者正在从零开始做领域专用本地模型:先用通用预训练+严格后训练得到一个负责推理和生成规格说明的模型,再由专注实现的编码模型简单执行,整体可被编排。核心观点是:MoE 虽激活参数少但整个模型必须驻留显存,对 8-16GB 显卡用户不友好;「一组专家模型 + 通用模型当编排器」 有机会在低端 PC 上打败 MoE,还能并行榨干 GPU。他的硬件是 28GB VRAM(4070 + 5060ti 16GB,x870e 主板),可以做双模型蒸馏和 RL 后训练,并呼吁社区合力训练社区模型。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →