Naive 发布 309B-A15.5B 混合专家模型:主打编码,1M 上下文

nullmove · reddit · 2026-09-28

Naive.ai 发布 Naive-N0.5-Flash,总参数 309B、激活约 15.5B 的 MoE 模型,定位编码与 AI 研发场景。模型支持 1M token 上下文,采用 Hybrid SWA/DSA(滑动窗口注意力与稀疏注意力混合)架构,研究页面已上线。

所属事件:NaiveAI 开源 309B MoE 模型 N0.5-Flash(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →