呼吁社区推广 LoRA 分发以节省下载带宽
Borkato · reddit · 2026-08-27
Reddit 用户发起讨论,建议创作者上传 LoRA(低秩适应)微调权重而非完整的模型文件。指出当前下载整个微调模型造成巨大的存储和带宽浪费,若社区统一在基础模型上分发 LoRA,将显著降低资源消耗并提高分发效率。
「Infra」频道最新
- QNX 携手 Hailo 做边缘 Physical AI:性能一致性提升 14 倍 — pdamodaran · 2026-08-27
- 美企算力优势达 15-20 倍,但在特定威胁下或无效 — ohlennart · 2026-08-27
- Hark 宣布与 NVIDIA 合作,获千兆级算力支持多模态系统 — adcock_brett · 2026-08-27
- Minimax H3 本地部署实测:5秒片段需4分钟 — thevictor390 · 2026-08-27
- GLM-5.3-Flash 支持百万上下文,实测速度超 160t/s — AutonomousHangOver · 2026-08-27
- llama.cpp 新增 TENSOR_READ_LAZY,MoE 模型活跃参数不再常驻显存 — jacek2023 · 2026-08-27