it.xnews.jp
出典: The GitHub Blog 原文公開: 2026-08-20 生成: 2026-08-21 読了 約 3 分 model: claude-haiku-4-5 原文: https://github.blog/news-insights/company-news/the-august-17-outage-and-the-work-ahead/ raw.md

GitHub、8月17日の大規模障害を報告―7時間47分間のサービス中断

TL;DR: GitHubは8月17日に7時間47分間にわたる大規模障害を経験し、github.com、認証、GitHub Actions、API、プルリクエスト、Issues、Copilotが影響を受けた。中央US データセンターの重要インフラストラクチャコンポーネントがトラフィック増加に対応できず、容量圧力がシステム全体に波及した。

GitHubは8月20日、8月17日に発生した大規模障害の詳細と今後の信頼性向上への取り組みを公表した。同障害はgithub.comの全機能に影響を与え、世界中の開発者と組織に支障をもたらした。

障害の原因と経過

障害はトラフィックが過去最高に達したとき、中央US データセンター内の重要インフラストラクチャコンポーネントがスケーリングに失敗したことで始まった。この容量圧力はシステム全体に波及し、認証機能に障害が発生して複数のGitHubサービスが中断した。復旧には、トラフィックの経路変更、影響を受けたインフラストラクチャの隔離、段階的なサービス復旧が必要だった。

一部のCopilotサービスは他のGitHubサービスよりも復旧に時間を要し、Copilotサービスのエラーがクライアント側のリトライループを引き起こし、復旧中のトラフィックが増加した。

GitHub障害の概要

急速な成長と容量圧力

GitHubのプラットフォームロードは急速に成長している。月別コミット数は2026年4月の14億件から8月には29億件へと倍増し、これがシステムへの圧力を説明している。GitHubは4月以降、CPU コア300万個以上とハイスピードストレージ120ペタバイトを追加してきた。

Azure上のGitHubプラットフォームロード割合は2026年5月の12%から8月には58%へと大きく拡大し、Azureはすべてのgit操作の約半分を処理している。

GitHub ActionsRunsの状況

今後の信頼性向上への取り組み

GitHubは複数の信頼性向上施策を実施中だ。より強力なテスト、より安全なロールアウト、より良い可視化、より効果的なアラートに投資している。さらに、重要なシステムを隔離し、システム間の共有依存関係を削除し、サービス間通信に一貫したリトライ上限、リトライ予算、可変タイムアウトを適用している。

8月6日のActions障害に続く今月2番目の大規模インシデントとなったこの障害について、Vladimir Fedorovは「その日にソフトウェアをリリースしようとしていたのであれば、我々はあなたを失望させた」と述べた。また「開発者コミュニティはGitHubに依存してアプリケーションをビルド、リリース、運用している。これは あなたが我々を信頼できるときにのみ可能である。8月17日はそうではなかった。これを修正することは我々の責任である」と表明した。

筆者の見立て

この記事は元記事の事実のみに基づいて自動生成されました。

出典

The GitHub Blog — "The August 17 outage, and the work ahead" https://github.blog/news-insights/company-news/the-august-17-outage-and-the-work-ahead/

この記事をシェア