开发者讨论 1bit 模型的 LoRA 支持与自定义 kernels
cephaloform · x · 2026-07-21
原帖称作者已经为这类工作准备了一套很强的 kernels,因此对进展很兴奋。
回复里提到想给 1bit 模型做 LoRA,但用 Prism 的方案一时还不明显怎么实现;不过作者表示自己的代码应当可以比较顺畅地支持。这条核心信息是:低比特模型微调与底层 kernel 实现的实际可行性。
所属事件:开发者探索 1bit 模型的多阶段蒸馏与 LoRA 适配(3 条相关)→
「Infra」频道最新
- Tabul AI 推出 Metal TreeSHAP,加速 Apple silicon 上的 Shapley 计算 — Scobleizer · 2026-07-22
- DeepSeek-V4-Flash 单卡 B300 批量仅 770 tok/s — Moreh · 2026-07-22
- NVIDIA 开始交付 102.4 Tbps 的 Spectrum-6 交换机 — nvidia · 2026-07-22
- Apple 公布 Private Cloud Compute 的 SOC 3 审计报告 — throwfaraway4 · 2026-07-22
- Reddit:GPU 平台总让你在代码、恢复、计费里选两项 — legendpizzasenpai · 2026-07-22
- 智能体执行环境的安全基石:沙盒化宣言 — spirosoik · 2026-07-22