wllama V3 发布,openjev 让大模型纯浏览器运行

开发者 ngxson 发布 wllama V3,这是 llama.cpp 的 WebAssembly 绑定,新增 WebGPU 与多模态支持,可让 LLM 推理完全在浏览器内完成,无需后端,GitHub 已获约 1.2k star。基于 wllama 驱动的 openjev 也随之亮相,可在浏览器内直接运行开源模型做本地推理。其上线的 SemIf 实验更进一步,实现纯浏览器端、无后端的语义 if 判断:用户给出状态、问题和允许的选项,模型直接在本地 GPU 上读出选项概率。

2026-09-19 ~ 2026-09-19 · 3 条相关