HuggingHack 增加 S3、MinIO、Ollama 和 vLLM 调度
TyedalWaves · reddit · 2026-07-27
作者公布了 HuggingHack 的一批重大更新:这是一个连接 Hugging Face、NAS/对象存储,以及运行 Ollama 或 vLLM 的机器的自托管控制层。
新增内容包括:本地账户、私有/共享模型仓库、可断点续传的浏览器上传、对 S3/MinIO/Ceph 的支持并保留本地 NAS 缓存、模型恢复/驱逐、把缓存模型派发到远端 Ollama 或 vLLM 机器、GGUF 元数据检查、可选 PostgreSQL、以及更强的安全机制。作者也明确表示,它不是聊天 UI,也不是模型服务替代品,而是介于存储与推理机器之间的管理层。
「编程与Agent」频道最新
- Tree-sitter 改写为 Rust 后解析提速 29.74%,但 ast-grep 曾回退 — mathemagic1an · 2026-07-27
- 有人把 ChatGPT 网页会话转成本地 Codex 会话 — georgemillo · 2026-07-27
- 做真实 SaaS 还不能一把梭,开发者先从数据模型入手 — doooyle · 2026-07-27
- 开源剖析器可追踪语音 Agent 每次 STT、LLM、TTS 调用 — mahimairaja · 2026-07-27
- GPT-5.6 因工具编排可比 5.5 多耗约 8 倍 token — breath_mirror · 2026-07-27
- 外部音频能否接入 LTX LoRA 视频工作流 — itchplease · 2026-07-27