SGLang新增支持DeepSeek-V4-Flash-Vision-Exp,附部署指南
ying11231 · x · 2026-09-01
SGLang项目宣布已支持DeepSeek-V4-Flash-Vision-Exp模型,并更新了cookbook。该模型是DeepSeek新发布的视觉模型,SGLang正在验证不同配置和硬件。文档提供了详细的部署命令和硬件要求。
「Infra」频道最新
- 40nm 存忆阻器芯片把缺陷变特性:比 A100 快 50-480 倍 — maier_ak · 2026-09-01
- 40nm 神经动力学芯片:利用电导漂移实现单次迭代 2.12ms 延迟 — maier_ak · 2026-09-01
- Qwen3.8 Flash 在双 DGX 上跑出 415 tok/s — NVIDIAAI · 2026-09-01
- 曝 OpenAI 自研芯片 Jalapeno:LLM 推理速度达 1500 tokens/s — firstadopter · 2026-09-01
- TensorSharp 跑 Qwen 3.8 Flash Next 性能实测 — fuzhongkai · 2026-09-01
- 腾讯混元 AngelSlim:Hy4 模型压缩至 214GB 并支持异构协同 — 腾讯混元 · 2026-09-01