2019 剪枝实验称可删 96% 权重,GPT-5 多数参数是空架子
TinfoilTricorn · x · 2026-09-12
一条被广泛转发的推文串:开发者 @yusufknl 推荐了一支 18 分钟视频,讲解为什么万亿参数模型的绝大部分权重并不必要。其核心论据是 2019 年 MIT 的剪枝研究——神经网络可以删掉约 96% 的权重而不损失性能,即所谓的「中奖彩票」(winning lottery ticket)子网络承担了几乎全部计算。
推文据此宣称 Claude 与 GPT-5 的权重大多是「空架子」,各 AI 实验室 90% 以上的 NVIDIA 预算因此被浪费。该说法沿用了热门营销式的夸张框架,剪枝结论来自早期小规模实验,未必直接适用于今天的稠密大模型,读者宜视为观点而非定论。
「Infra」频道最新
- 300K 上下文也扛不住大代码库,本地长任务如何自动交接 — Developer-Y · 2026-09-12
- 24GB M5 MacBook Air 离线跑 LLM,选哪个 MoE 够快够好 — itis_whatit-is · 2026-09-12
- 16GB 显存跑 Qwen3.8 27B:DFlash2 草稿模型实测 60 tok/s — pneuny · 2026-09-12
- DeepSeek v4.1 Flash 本地实测:q2 量化 16 tok/s,工具调用选错率高 — challis88ocarina · 2026-09-12
- smolbenchmark:按你的 8GB 硬件实测选出最合适的小模型 — East-Muffin-6472 · 2026-09-12
- Tenstorrent 前高管创办 ai&,在日本棕地站点部署非英伟达算力 — DavidBennett__ · 2026-09-12