首页 > 开源 > GitHub 宕机超过 7 小时,AI 编码狂潮把基础设施压垮了

GitHub 宕机超过 7 小时,AI 编码狂潮把基础设施压垮了

OSChina资讯 2026-08-18 11:34 2 阅读 查看原文

2026 年 8 月 17 日,周一,中国时间晚上 9:40 左右,GitHub 开始大面积宕机。

这次宕机持续了超过 7 个小时,直到 8 月 18 日凌晨 5:15(北京时间)才宣告完全恢复。受影响的服务覆盖了 GitHub 几乎全部核心功能:网站、API、Pull Request、Actions、Webhooks、Issues、Git Operations,以及 GitHub Copilot。

这是 GitHub 今年以来最严重的一次中断。

时间线:从 20% 到全面恢复

根据 GitHub Status 页面的记录,故障从 Aug 17, 2026 13:40 UTC 开始。一小时内,灾难蔓延到几乎所有服务——API Requests、Webhooks、Actions、Pull Requests、Git Operations、Issues、Pages 相继亮起红灯。

官方在 14:58 UTC 给出了第一个关键数据:Web 体验和 API 流量的错误率约 20%,而归档下载和原始仓库内容下载的错误率高达 50%。SAML/OIDC 认证、SCIM 和 Team Sync 也受到影响。

这意味着什么?

简单说:你 push 不了代码,CI/CD 跑不起来,PR 合并不了,连下载 zip 包都有 50% 的概率失败。

16:36 UTC,GitHub 定位到了「问题组件」并采取了纠正措施,出现了「强烈的恢复信号」。但事情没那么简单——认证系统出现间歇性故障,Copilot 登录也出了问题。

直到 21:15 UTC,GitHub 才宣布事件完全解决,并表示将发布详细的根因分析(RCA)。

不是第一次,也不是意外

这次宕机并非孤立事件。相关报道指出,GitHub 已经为 AI 驱动的编码狂潮挣扎了数月。

GitHub CTO Vladimir Fedorov 在今年 4 月的博客中写道:公司去年秋天开始着手将基础设施容量扩展 10 倍,到 2 月又得出结论——需要为当前规模的 30 倍做准备。

6 月,微软发言人向 Business Insider 承认,AI 智能体开发(AI agent development)的激增已经触及 GitHub 基础设施的极限。微软正在加速将 GitHub 迁移到 Azure,同时采取多云策略——包括从 AWS 租用容量。没错,微软旗下的代码托管平台,要从竞争对手 AWS 租服务器。

GitHub 平台增长数据

GitHub 目前有 2.25 亿用户。AI 编码工具 GitHub Copilot 和 AI agent 的开发工作流正在以远超预期的速度消耗基础设施资源。因为每个 agent 都是一个持续运行的推理循环,涉及大量 API 调用和代码生成。

人话总结

一个周一早上,全球开发者发现自己的代码推不上去、PR 合并不了、CI 不跑、Copilot 也挂了。

七个半小时后,好了。

GitHub 的 RCA 还在路上,但根因方向已经很清楚:AI 编码工具的爆发式增长正在以一种前所未有的方式吞噬基础设施。你可以把容量扩 10 倍,但需求可能已经涨了 30 倍。


参考来源: