开源 SparklingKit:让 DGX Spark 一台机器同时跑六大本地 AI 工具
IanAndrewsDC · x · 2026-09-03
一位花 4,699 美元买了 NVIDIA DGX Spark 的用户分享:最初只把它当聊天机器人用,直到某次要转录客户电话录音时才意识到 128GB 统一内存能同时驻留一整队专用模型,无需为转写、OCR 各自付费云服务。由此催生了开源(Apache 2.0)工作台 SparklingKit。
- 六大工具一个面板:录音转写(长音频智能分块,导出 Markdown/JSON/SRT/VTT)、文档 OCR 转 Markdown、双栏实时翻译、视觉定位(对图片做最多 12 条自然语言查询并画框)等
- 统一内存的论点:普通游戏 GPU 只能装一个模型,128GB 机器可以同时保留聊天、转写、翻译、图像等多个专用模型
- 全流程本地:一机一目录,支持工具间结果串联,Docker 一行命令安装,零云端依赖
适配 DGX Spark 等统一内存设备,主打隐私与替代五份云订阅。
「Infra」频道最新
- Agentic API:在 vLLM 前加有状态层,把编排从客户端搬进服务端 — techNmak · 2026-09-03
- Google 发布 Gemini 3.8 Flash:干得更多但可能花更多 token — The Verge AI · 2026-09-03
- Mitchell Hashimoto 公开 Superlogical 服务器内存优化实录 — sull · 2026-09-03
- Lily 跑分:M5 Max 上预填吞吐高 MLX-LM 23%,解码高 35% — perplexity_ai · 2026-09-03
- Perplexity 开源本地推理引擎 Lily,专为 Apple 芯片上的 Qwen3.6 打造 — perplexity_ai · 2026-09-03
- FastH3 实现本地推理:支持 Apple Silicon 与 DGX Spark — Vandy_simp · 2026-09-03