browser-llm-fit:下载前先测模型能否在你的浏览器跑

init0 · reddit · 2026-09-04

开发者 hemanth 发布开源工具 browser-llm-fit,解决 WebGPU 浏览器跑本地模型时的常见崩溃:模型超出 maxStorageBufferBindingSize 或缺少 shader-f16 支持导致标签页挂掉。该工具在下载权重前探测客户端硬件限制,并按适配度排序可运行的模型。fit('model') 测试单个模型(如返回 fits 与预估速度 45-65 tokens/sec),fit() 返回全部适配排序。提供在线演示、GitHub 仓库与 npm 包。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →