Hermes 上线本地后端,一键运行 Unsloth GGUF 量化模型
danielhanchen · x · 2026-09-04
Unsloth 宣布其 GGUF 量化模型现可在 Hermes 中一键本地运行,danielhanchen(Unsloth 作者)确认 Hermes 已新增本地后端,支持 DeepSeek-V4-Flash、Qwen3.8-27B、3.6-35B-A3B 和 Qwen3.8-Flash-Next 的 Unsloth UD-Q4KXL 与 UD-Q4KM 量化版本。
「Infra」频道最新
- 华尔街筹备 Nvidia GPU 租金期货,算力正变成大宗商品市场 — VraserX · 2026-09-04
- RTX 4060 Ti 16GB 本地跑 MiniMax 视频模型,768p 五秒仅需三分钟 — aziib · 2026-09-04
- 预测:至 2035 年智能体 AI 将带动企业流量增长 9 倍 — Beth_Kindig · 2026-09-04
- NSF 设立 NAIRR 运营中心,扩大全国 AI 研究资源开放 — DavidJLockett · 2026-09-04
- MLX-Serve v26.9.1 发布:贴一张截图即可一键跑 Qwen Flash 模型 — TheMoonMidas · 2026-09-04
- 开发者盛赞 Cloudflare Wrangler 是最友好的 Agent 基础设施 CLI — dinasaur_404 · 2026-09-04