FastH3 实现本地推理:支持 Apple Silicon 与 DGX Spark
Vandy_simp · reddit · 2026-09-03
FastVideo 团队发布了 FastH3 的本地推理路径:通过 MLX 支持 Apple Silicon,也支持一到两台 NVIDIA DGX Spark。维护的 recipes 通过 Python、命令行工具和本地 OpenAI 兼容服务器/playground 暴露,覆盖安装、权重转换、内存约束与可复现生成。团队强调目前尚不是开箱即用的 ComfyUI 拖拽式工作流,并询问社区最需要哪种集成方式(原生节点、对接本地服务器的 API 节点,或示例工作流)。代码已开源在 GitHub。
「Infra」频道最新
- llama.cpp 弃用 --chat-template-kwargs,推理保留默认开启 — Bulky-Priority6824 · 2026-09-03
- Agentic API:在 vLLM 前加有状态层,把编排从客户端搬进服务端 — techNmak · 2026-09-03
- Google 发布 Gemini 3.8 Flash:干得更多但可能花更多 token — The Verge AI · 2026-09-03
- Mitchell Hashimoto 公开 Superlogical 服务器内存优化实录 — sull · 2026-09-03
- Lily 跑分:M5 Max 上预填吞吐高 MLX-LM 23%,解码高 35% — perplexity_ai · 2026-09-03
- Perplexity 开源本地推理引擎 Lily,专为 Apple 芯片上的 Qwen3.6 打造 — perplexity_ai · 2026-09-03