阿里发布 Qwen3.8-Max:2.4T 参数与百万上下文
FellMentKE · x · 2026-08-06
阿里巴巴与通义千问团队发布了迄今最强大的旗舰模型 Qwen3.8-Max。
- 架构与规模:基于 Sparse MoE 架构,总参数量达 2.4T,实际激活参数仅为 95B,兼顾前沿性能与高效推理。
- 上下文与模态:原生支持图文多模态,具备 100 万 token 的超长上下文窗口,能处理 200 页以上的长文档或 100 小时的视频流。
- 智能体能力:专为长周期复杂任务设计,官方称其能独立完成耗时 16 天的真实软件工程项目,并在 WWW2025 多模态对话意图识别挑战赛中超越人类。
「模型」频道最新
- Hark发布Handoff模型,宣称超越ChatGPT 5.4和Opus 4.8 — peterjliu · 2026-08-06
- 受限于额度与降智,开发者开始转向 Kimi K3 等开源模型 — casper_hansen_ · 2026-08-06
- DeepSeek Flash v4 恢复服务,编码与聊天体验大幅提升 — bindureddy · 2026-08-06
- 实测 ChatGPT-5.6-luna:日常文本处理成本仅为竞品三分之一 — zakkohane · 2026-08-06
- 通义千问 Qwen3.8-Max 发布,原生多模态推理 — FellMentKE · 2026-08-06
- 开发者吐槽 GPT 5.6 编码失控:生成 30 个文件却写不好基本句子 — obinopaul · 2026-08-06