美团开源 LongCat-Flash-Lite-Sparse,24GB 显存跑 256k 上下文

Gohab2001 · reddit · 2026-07-31

美团发布了开源模型 LongCat-Flash-Lite-Sparse。该模型采用 MoE(混合专家)架构,拥有约 30B 的 n-gram 查找表并将其卸载至内存(RAM),同时激活参数仅为 3B。

这种设计使得模型在仅使用 24GB 显存的情况下,即可支持快速的 256k 超长上下文处理。发帖者分析指出,该技术思路类似于 Gemma 4 的 PLE(参数化专家层)技巧,但在综合能力上目前尚无法替代 Qwen 3.6 27b。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →