깃허브, 이슈·PR·웹훅 일시 장애 후 복구… 기업용 마이그레이션은 중단 상태
개발자 협업 플랫폼 깃허브(GitHub)에서 이슈, 풀 리퀘스트(PR), 웹훅 등 여러 서비스가 한때 제대로 작동하지 않았다. 깃허브 공식 상태 페이지에 따르면 회사는 협정세계시(UTC) 기준 10월 6일 저녁, 한국시간으로는 7일 새벽 'Several services are degraded(여러 서비스 성능 저하)'라는 제목의 장애 공지를 올렸다. 대부분의 서비스는 곧 정상으로 돌아왔다. 다만 마지막 공지 시점까지 '엔터프라이즈 마이그레이션' 작업은 재개되지 않았다.
상태 페이지에 남은 기록을 한국시간으로 바꿔 보면 흐름은 이렇다. 오전 5시 4분께 웹훅 관련 업데이트가 올라왔고, 5시 12분에는 "풀 리퀘스트가 정상 작동 중"이라는 공지가 나왔다. 5시 22분 깃허브는 "이슈, 풀 리퀘스트, 웹훅을 포함한 여러 서비스가 잠시 저하됐지만 지금은 복구됐다"고 밝혔다. 이어 "원인과 완화 조치를 검증하는 동안 엔터프라이즈 마이그레이션은 일시 중지한다"고 덧붙였다. 4분 뒤인 5시 26분에는 상태를 '모니터링'으로 바꾸고 "성능 저하는 완화됐으며 안정성을 확인하고 있다"고 알렸다.
5시 57분 깃허브는 "엔터프라이즈 마이그레이션을 제외한 모든 서비스가 정상 작동하고 있다"며 "마이그레이션은 아직 중지 상태지만 곧 재개될 것"이라고 공지했다. 6시 29분에는 "엔터프라이즈 마이그레이션 처리를 다시 시작할 수 있도록 완화 조치를 마련하고 있다"고 밝혔다. 이 공지가 확인된 마지막 업데이트이며, 마이그레이션이 실제로 재개됐는지는 확인되지 않았다.
장애가 정확히 언제 시작됐는지, 원인이 무엇인지도 공개되지 않았다. 확보한 상태 페이지 기록은 웹훅 관련 업데이트(UTC 20시 4분)에서 잘려 있어 그 이전의 최초 공지 시각과 내용은 확인할 수 없었다. 이용자가 얼마나 영향을 받았는지, 특정 지역에 국한된 문제였는지에 대한 설명도 없다.
이번에 영향을 받은 기능은 모두 개발 실무에 직접 쓰이는 것들이다. 이슈는 버그 보고와 작업 관리에, 풀 리퀘스트는 코드 검토와 병합에 쓰인다. 웹훅은 저장소에서 일어난 일을 외부 시스템에 자동으로 알리는 기능이다. 많은 기업이 웹훅을 지속적 통합·배포(CI/CD) 파이프라인이나 메신저 알림과 연결해 쓰기 때문에, 웹훅이 잠시만 멈춰도 빌드나 배포가 실행되지 않거나 알림이 누락될 수 있다. 장애는 한국시간 새벽에 일어나 국내 업무 시간 전에 대부분 복구됐다. 다만 이 시간대에 자동화 작업을 돌렸거나 해외 조직과 협업하는 국내 개발팀이라면 해당 시간의 웹훅 전송 기록과 파이프라인 실행 결과를 다시 확인해 보는 것이 좋다.
복구가 늦어지고 있는 엔터프라이즈 마이그레이션은 기업 고객이 저장소나 조직을 깃허브의 기업용 환경으로 옮기는 작업을 가리킨다. 깃허브가 다른 서비스를 복구한 뒤에도 이 작업만 따로 멈춰 둔 것은 원인을 검증하는 동안 대량 이전 작업이 추가 문제를 일으키지 않게 하려는 조치로 보인다. 다만 회사는 구체적인 이유를 밝히지 않았다. 현재 마이그레이션을 진행 중이거나 일정을 잡아 둔 기업은 깃허브 상태 페이지(https://www.githubstatus.com/incidents/cjwszcf57bff)에서 재개 여부를 확인한 뒤 작업 일정을 조정해야 한다.