MLX-Serve v26.9.1 发布:贴一张截图即可一键跑 Qwen Flash 模型
TheMoonMidas · x · 2026-09-04
MLX-Serve v26.9.1 发布,由 @pidotdev 与多位贡献者(尤其 @Beamsters1 负责优化与正确性测试)完成。作者展示了一个演示:只需粘贴一张包含 prompt 的截图,新版本就能一次跑通输出,配合阿里巴巴 Qwen Flash 模型使用效果出色。
「Infra」频道最新
- 华尔街筹备 Nvidia GPU 租金期货,算力正变成大宗商品市场 — VraserX · 2026-09-04
- RTX 4060 Ti 16GB 本地跑 MiniMax 视频模型,768p 五秒仅需三分钟 — aziib · 2026-09-04
- 预测:至 2035 年智能体 AI 将带动企业流量增长 9 倍 — Beth_Kindig · 2026-09-04
- NSF 设立 NAIRR 运营中心,扩大全国 AI 研究资源开放 — DavidJLockett · 2026-09-04
- Hermes 上线本地后端,一键运行 Unsloth GGUF 量化模型 — danielhanchen · 2026-09-04
- 开发者盛赞 Cloudflare Wrangler 是最友好的 Agent 基础设施 CLI — dinasaur_404 · 2026-09-04