GLM 5.3 与 Qwen3.8 Flash 即将发布,支持 DGX Spark 部署
TheZachMueller · x · 2026-08-26
两个新模型即将发布,针对 DGX Spark 用户优化:
- Qwen3.8 Flash:可在单个 DGX Spark 上使用 NVFP4 运行。
- GLM 5.3 Flash:可能需要两个 DGX Spark。
这两个模型的发布将显著提升该硬件平台的可用性。
所属事件:阿里官宣 Qwen3.8-Flash-Next,Qwen4 架构预览 8 月 26 日开源(13 条相关)→
「Infra」频道最新
- Vemetric 发布 Outbid 流量冲击事故复盘 — jonathan_wilke · 2026-08-26
- 观点:本地 AI 是计算的太阳能 — heyneighbor · 2026-08-26
- Archil 存储写入速度达 S3 Express One Zone 两倍 — s4chinraja · 2026-08-26
- 北欧数据中心供电告急,AI 繁荣伴随高昂账单 — nordicinst · 2026-08-26
- Cerebras CS4 速度 30 倍于 GPU,但成本高 200 倍 — zephyr_z9 · 2026-08-26
- 建议:低流量检索首选 BM25 全文搜索 — petrusenko_max · 2026-08-26