代码泄露 Qwen3.8-35B-A3B 参数,显存优化更激进
cephaloform · x · 2026-08-15
GitHub 代码提交表明确实存在 Qwen3.8 模型家族,其中包含 35B 总参数、约 3B 激活参数的 A3B 版本。该模型延续了 Qwen3.6 的 MoE 架构,针对 8-16GB 显存设备进行了优化,有望延续此前在消费级显卡上的运行优势。
「模型」频道最新
- llama.cpp 集成 Moonshot Kimi-K3 文本模型 — pmttyji · 2026-08-15
- GLM 5.3 技术报告揭示使用合成 RL 环境训练 — burny_tech · 2026-08-15
- Qwen2.5 vs Qwen2 vs Gemma 4:30B级开源模型实测 — MaySaki2 · 2026-08-15
- 测试 Fable 5 模型用于蒸馏的重定向行为 — teortaxesTex · 2026-08-15
- Gemini 3.7 Flash:可实时生成完整交互式网站 — _philschmid · 2026-08-15
- Qwen 3.8 27B 在某 Harness 下几乎不思考的测试 — rosie254 · 2026-08-15