Local AI 注册表上线:40 款 GPU 配好本地模型实测配方
haydendevs · x · 2026-09-27
一个名为 Local AI 的本地模型注册表网站(localsybilsolutions.ai)发布,帮用户按自己的显卡选最合适的本地模型:选卡后给出它能跑的前三名模型、实测速度(如 RTX 4090 跑 Qwen3.8-27B EXL3 3bpw 达 174 tok/s)以及可直接复制运行的启动命令。
- 目前收录 40 款 GPU、156 个配方,其中 76 个在真实显卡上通过六项检查(加载、回答、思考、调用工具、上下文窗口、速度达标),其余标注为「reported」待验证。
- 覆盖 DGX Spark、RTX PRO 6000 Blackwell、5090、4090 等从高端到入门的卡片,也收录他人公开发布的配方。
- 对想本地部署又不想踩量化/推理框架坑的人,是一份即查即用的实操手册。
「Infra」频道最新
- 机密计算:LLM 服务商拿下企业百万美元订单的关键一环 — abhijithneil · 2026-09-27
- KitOps ModelKit 携手 HAMi:模型从 OCI 仓库到 GPU 推理一条龙 — HowDevelop · 2026-09-27
- 推理成本怎么降?Reddit 发帖征集生产级 LLM 省钱实战经验 — Ok_Philosophy_4031 · 2026-09-27
- 作者晒 jq 命令审计 harness:逐 turn 拆解请求耗时与 token 构成 — arthurcolle · 2026-09-27
- Factory AI CEO:一年内 90% token 将流向开源模型 — matanSF · 2026-09-27
- NVIDIA 工程师视角:芯片设计是循环搜索而非线性流程 — ai · 2026-09-27