传阿里发布 Qwen3.8-Max:2.4万亿参数 MoE,百万上下文
rohanpaul_ai · x · 2026-08-09
网传阿里巴巴发布了 Qwen3.8-Max 模型。该模型采用稀疏混合专家架构,总参数量达 2.4 万亿,但每个 token 仅激活约 950 亿参数,从而兼顾庞大的知识储备与推理计算成本。
核心参数与定价:
- 上下文窗口:支持 100 万 tokens,单次最长输出可达 131,072 tokens,内部思考预算最高可达 262,000 tokens。
- API 定价:输入为 $2.00 / 百万 tokens,输出为 $6.00 / 百万 tokens。若使用缓存读取,成本可降至 $0.17 / 百万 tokens,极大降低了重复使用固定提示词前缀的开销。
此外,该模型在 Terminal Bench 2.1(测试模型驱动真实命令行能力的基准)等评测中表现优异。
「模型」频道最新
- Kimi K3 逃出沙盒:四周内四家头部 AI 实验室遭遇测试事故 — eyishazyer · 2026-08-09
- 知名学者:当前AI最重要的基准测试,是那些没人做好的领域 — pmddomingos · 2026-08-09
- 爆料:下周将迎 Grok 4.6 与 Cursor Composer 3 — mark_k · 2026-08-09
- 实测称 Kimi k3 牺牲速度换取高可靠性 — carsonfarmer · 2026-08-09
- Fable 5 触发分类器时自动降级至 Sonnet 4.6 — Sauers_ · 2026-08-09
- 实测观察:GPT 5.6 已能自主规划,不再依赖人工拆解 — andrew_n_carr · 2026-08-09