llama.cpp 合并 Qwen3.8-Flash-Next 支持,GGUF 格式可下载
jacek2023 · reddit · 2026-08-28
llama.cpp 已合并对 Qwen3.8-Flash-Next 的支持,用户现在可以直接下载该模型的 GGUF 格式文件,在本地运行这颗阿里的新模型。
「Infra」频道最新
- Anthropic与HHMI合作推出模型硬件标准,推动AI硬件互操作 — thebasepoint · 2026-08-28
- 富兰克林基金经理:AI 投资 ROI 决定芯片需求能否持续 — IBDinvestors · 2026-08-28
- Token 价格具有误导性:多轮筛选导致实际成本激增 — andreisavu · 2026-08-28
- Lambda 获 9.26 亿美元投资级贷款,用于 GPU 部署 — TheZachMueller · 2026-08-28
- 英美算力基建对比:英国受电网制约,美国协同建设 — NinaDSchick · 2026-08-28
- 推理两小时成本估算:Claude 或耗资 1382 万美元 — GregKamradt · 2026-08-28