美团开源 LongCat-Flash-Lite-Sparse,24GB 显存跑 256k 上下文
Gohab2001 · reddit · 2026-07-31
美团发布了开源模型 LongCat-Flash-Lite-Sparse。该模型采用 MoE(混合专家)架构,拥有约 30B 的 n-gram 查找表并将其卸载至内存(RAM),同时激活参数仅为 3B。
这种设计使得模型在仅使用 24GB 显存的情况下,即可支持快速的 256k 超长上下文处理。发帖者分析指出,该技术思路类似于 Gemma 4 的 PLE(参数化专家层)技巧,但在综合能力上目前尚无法替代 Qwen 3.6 27b。
「模型」频道最新
- 实测:ChatGPT引用旧URL,2周未更新 — lilyraynyc · 2026-07-31
- 特定提示词可绕过限制,实测解锁 Claude Opus 底层能力 — paul_cal · 2026-07-31
- OpenAI 降价、DeepSeek 更新,Anthropic 被指陷性价比困局 — kimmonismus · 2026-07-31
- DeepSeek-V4-Flash 推理实测:400 tps 速度仅需 10 美元/时 — ben_burtenshaw · 2026-07-31
- MiniMax H3 登顶视频编辑榜,官方宣布即将开放权重 — multimodalart · 2026-07-31
- OpenAI 模型推理成本四个月降13倍,奥特曼称要超越摩尔定律 — inductionheads · 2026-07-31