Intel 发布 OpenVINO 2026.4:新增 Qwen3-VL、FLUX.2 等本地推理支持
jacek2023 · reddit · 2026-09-17
Intel 发布 OpenVINO 2026.4,重点更新:
- 新增模型支持:CPU 上支持 Gemma-3n;CPU/GPU 支持 Kokoro-82M、Qwen3-VL-4B (eagle3)、Qwen3-ASR、Muse Glimmer 30B、DeepSeek OCR-2、Granite 4.0 等;NPU 上支持 FLUX.2-Klein 4B 和 Kokoro 82M。
- 推理加速:GenAI 为 Gemma 4 与 Qwen 3.5/3.6 增加 Multi-Token Prediction 投机解码;EAGLE3 支持 Tree Drafting (Top-K) 提升视觉语言模型吞吐;Core Ultra Series 3 的 Xe3 核显针对长上下文 Gemma 4 优化。
- 开发体验:ITT 性能分析扩展到 NPU,可用 VTune 统一分析 CPU/GPU/NPU;Node.js 新增 ASRPipeline,JS 开发者可跑 Whisper 等流式语音识别。
- 预览特性:NPU 有界动态形状支持扩展到视觉负载(如超分);Model Server 支持空闲模型自动卸载以省内存。
「Infra」频道最新
- 71% 美国人反对在本地建 AI 数据中心,反对率超核电站 — DavidLinthicum · 2026-09-17
- 苏格兰数据中心新提案延批一年,学者呼吁澳大利亚效仿 — TobyWalsh · 2026-09-17
- huggingface_hub 1.32:UV 脚本头可声明运行时镜像,一键在 HF Jobs 运行 — vanstriendaniel · 2026-09-17
- 开源 Qwen-1B-RLCD:并行解码让 JSON 推理快 5 倍 — JiliJeanlouis · 2026-09-17
- Fathom 按查询自适应读位宽,百万 token KV 扫描提速 1.67 倍 — Vivek Kalyanarangan · 2026-09-17
- 单张 24GB 跑 35B MoE:SSD 流式推理引擎 Edge0 达 20 token/s — Edge0 · 2026-09-17