GLM5.3-Flash 出现 DGX Spark 专用量化版,nvfp4 格式登上 HF 热榜
autotrust · hf · 2026-10-08
一个面向 NVIDIA DGX Spark(GB10/Blackwell 架构)的 GLM5.3-Flash E224 量化模型 autotrust/GLM5.3-Flash-E224-DGX-Spark 登上 Hugging Face 热门榜。该模型为 image-text-to-text 类多模态模型,采用 safetensors 格式,针对 vLLM 推理优化,使用 nvfp4 量化与 modelopt 处理,基于 GLM-5-Next 的 MoE 架构,方便在 DGX Spark 端侧设备上本地部署。
「模型」频道最新
- Claude Haiku 5.5 登顶 RamenBench:连续运行 45 分钟耗 42 万 tokens 仅 $2.06 — aitrendz_xyz · 2026-10-08
- 同题对决 Haiku 5.5 vs Opus 5.5:前者 15 分钟完工,后者超 1 小时更精细 — aitrendz_xyz · 2026-10-08
- Haiku 5.5 发布即引发热议,网友晒出 10 个低成本玩法 — aitrendz_xyz · 2026-10-08
- OpenAI 数学突破后,LLM 数学能力质疑声消失了 — burny_tech · 2026-10-08
- 求推荐本地叙事模型:8GB 显存能跑的最佳故事生成模型是哪个? — opUserZero · 2026-10-08
- 实测对比:Opus 5.5 创意生成碾压 Sonnet 5.5,毫无悬念 — tobowers · 2026-10-08