NaiveAI 开源 309B MoE 模型 N0.5-Flash:由 AI 主导研发、推理可达 2000 tok/s
Xianbao_QIAN · x · 2026-09-28
NaiveAI 发布并开源(MIT 协议)Naive-N0.5-Flash,主打「用 AI 造前沿 AI」:
- 架构:309B MoE、15.5B 激活参数;原生 1M 上下文,无全注意力层,采用 SWA 与轻量 DeepSeek Sparse Attention(DSA)混合注意力设计。
- 定位:面向编码与 AI 研发,官方称编码能力属第一梯队,AI R&D 能力领先;并训练其参与研发流程,探索递归自我改进(RSI)路径。
- AI 主导研发:架构探索、训练/推理/部署系统优化均由 AI 完成,人类负责方向、约束与关键决策;配套基础设施每周服务近千万沙箱,峰值并发 10 万。
- 推理性能:AI 优化的推理运行时,Ultrafast 模式最高 2000 tok/s。
权重已在 Hugging Face 与 GitHub 开放,附技术博客。
「模型」频道最新
- 用户实测:Opus 5.5 聪明绝顶,但 Sol+Astra 操控电脑更稳留住了他 — vivekhaldar · 2026-09-28
- 长文后半段循环元凶是采样器:NeurIPS 论文为模型洗冤 — menhguin · 2026-09-28
- Qwen3.8-27B 高效思考微调版 ThinkingCap 登上 HF 热榜 — bottlecapai · 2026-09-28
- 学者断言:LLM 已根本解决常识问题,物理常识是下一前沿 — ipeirotis · 2026-09-28
- 用户反馈 GPT Sol 系列疑似被降智,质量下降帖增多 — PressPlayPlease7 · 2026-09-28
- 曝 OpenAI DevDay 将展示持久记忆 Agent 与 io 硬件 — VraserX · 2026-09-28