GitHub объяснил причины почти семичасового сбоя перегрузкой дата-центра
GitHub опубликовал отчёт о причинах сбоя, который произошёл 17 августа 2026 года и продолжался 6 часов 42 минуты. Неполадки нарушили работу репозиториев, pull request, пайплайнов Actions и ассистента Copilot. Одновременно отказала корпоративная система единого входа: перестали работать протоколы SAML, OIDC, синхронизация команд и SCIM-подготовка. Инженеры восстановили штатный режим к 20:22 UTC.
Согласно отчёту компании, сбой случился без обновлений кода или изменений конфигурации. Причиной стал отказ масштабирования критического узла под пиковой нагрузкой в дата-центре региона Central U.S. На пике аварии частота ошибок в API и pull request достигала 20%, а при выгрузке архивов и сырых файлов доходила до 50%. Восстановление осложнили каскадные повторные запросы, которые генерировал Copilot.
Авария стала седьмым инцидентом на платформе за пятнадцать дней. Ранее технический директор GitHub Влад Федоров признавал, что сервису требуется редизайн под тридцатикратный рост нагрузки из-за активности автономных кодинг-агентов. По подсчётам LeadDev, с мая 2025 по апрель 2026 года платформа пережила 257 сбоев, из которых 48 были крупными. Отдельно на сервис Actions пришлось 57 отключений за год.