GitHub 宕机近 8 小时,官方披露扩容失败根因
mariorod1 · x · 2026-08-21
GitHub 官方发布 8 月 17 日重大宕机事故复盘。该事故持续 7 小时 47 分钟,导致全球服务中断。核心原因是美中数据中心关键基础设施组件在流量峰值时未能自动扩容,引发级联故障。
关键细节:
- 事故并非代码或配置变更导致,而是容量规划失误。
- 月度提交量从 4 月的 14 亿激增至 29 亿,需求增长超过预期。
- Copilot 客户端重试循环加剧了恢复期的流量压力。
官方表示将加速可靠性工程工作,以应对快速增长的需求。
所属事件:GitHub 发布近 8 小时重大宕机事故复盘(2 条相关)→
「Infra」频道最新
- 民调:美民众反对本地数据中心比例飙升至 75% — Polymarket · 2026-08-21
- Ramp Router 宣布 GPT-5.6 Sol 推理价格减半 — KlausCodes · 2026-08-21
- 研究员吐槽:每年因会议被占用的算力资源惊人 — ChongZzZhang · 2026-08-21
- AT&T 将 40% 员工 AI 用量转至开源模型 — Hesamation · 2026-08-21
- 算力需求展望:内存与硅产能将翻 4 倍,旧芯片仍能跑大模型 — teortaxesTex · 2026-08-21
- 阿里云 Qwen 开源模型带来回报,三年 390 亿投入显效 — TiernanRayTech · 2026-08-21