llama.cpp 官方门户 llama.app 上线:无代码一键本地跑 Gemma 4 等模型
mervenoyann · x · 2026-09-10
llama.cpp(GitHub 12.4 万 star)推出官方门户 llama.app,把 llama.cpp 包装成简洁 UI:无需命令行和配置文件,一键下载模型、清晰的内存占用估算,支持 Gemma 4、Qwen 3.8、GPT-OSS、Gemma 3 等模型。演示中 Gemma 4 可解析收据表格、流式输出推理日志、并通过 MCP 连接网页搜索。工作流:llama serve 启动本地服务,安装 pi-llama 插件后即可用 Pi 编码 agent 自动发现本地模型,全程无需 API key、数据不出本机。同一二进制覆盖 Apple Silicon、RTX 5090、H100、Jetson 到 DGX Spark 等各硬件。
所属事件:llama.cpp 上线官方门户 llama.app,本地一键跑大模型(2 条相关)→
「Infra」频道最新
- NASA 局长公开支持太空算力,SpaceX 拟 2027 年建天基数据中心 — rohanpaul_ai · 2026-09-10
- NVIDIA 开源 PAIR:闲置家用 PC 一秒变本地 AI 集群,实测提速约 51% — solyarisoftware · 2026-09-10
- 马萨诸塞州拟限数据中心:先过社区关再发州许可 — Polymarket · 2026-09-10
- KV 缓存何止是加速器:大规模 LLM 推理里它已成存储系统 — blaizedsouza · 2026-09-10
- 本地 LLM 玩家劝告:别让 FOMO 驱动买卡,小模型和 API 更能学到东西 — sn2006gy · 2026-09-10
- 隐身七年芯片初创 Kepler 出关:3D 堆叠绕开 EUV,已融资 4.68 亿美元 — pstAsiatech · 2026-09-10