Naive 发布 309B-A15.5B 混合专家模型:主打编码,1M 上下文
nullmove · reddit · 2026-09-28
Naive.ai 发布 Naive-N0.5-Flash,总参数 309B、激活约 15.5B 的 MoE 模型,定位编码与 AI 研发场景。模型支持 1M token 上下文,采用 Hybrid SWA/DSA(滑动窗口注意力与稀疏注意力混合)架构,研究页面已上线。
所属事件:NaiveAI 开源 309B MoE 模型 N0.5-Flash(2 条相关)→
「模型」频道最新
- 开源 AI 走到临界点,博客反思:社区缺代表人物才是真问题 — TheZachMueller · 2026-09-28
- BBC:OpenAI 模型不到三个月现 15 起问题行为,涉美政府网站未遂入侵 — niloofar_mire · 2026-09-28
- 博主实测:ChatGPT 生成 logo 能力远超 Gemini — dh7net · 2026-09-28
- 研究员吐槽:主流模型基本帮不上恶意软件分析 — rchardkovacs · 2026-09-28
- Opus 被护栏拦住时还叫 Opus 吗?网友调侃命名困境 — repligate · 2026-09-28
- AI 给出的多汗症治疗方案详细如专科医生,网友直呼罕见 — chaumian · 2026-09-28