하루위키
IT·서비스종결

페이스북·인스타그램·왓츠앱 전 세계 6시간 동시 다운 사태

2021-10-04 — 2021-10-05

최종 갱신

이 문서는 실제 사건·사고를 시간순으로 정리합니다. 편집 시 신뢰할 수 있는 출처를 반드시 밝혀 주세요.

1. 개요[편집]

2021년 10월 페이스북의 네트워크 설정 오류로 페이스북·인스타그램·왓츠앱·메신저가 전 세계에서 약 6시간 동안 동시에 먹통이 되며 수십억 이용자가 피해를 본 대규모 IT 장애 사건이다.

2. 전개 과정[편집]

6개 기록 · 2021-10-04 15:39 ~ 2021-10-04

  1. BGP 경로 대량 철회로 페이스북 계열 서비스 전면 다운 시작

    2021년 10월 4일 오후 3시 39분(UTC) 페이스북은 백본 네트워크 용량을 점검하는 정기 유지보수 작업 중 실수로 데이터센터 간 연결에 사용되는 경계 경로 프로토콜(BGP) 경로를 대량으로 철회하는 명령을 실행했다. 이 명령은 감사 도구의 버그로 인해 원래 의도와 달리 페이스북의 모든 데이터센터를 인터넷에서 한꺼번에 분리시키는 결과를 낳았다. 그 여파로 페이스북 자체의 도메인네임서버(DNS) 경로까지 사라지면서 페이스북, 인스타그램, 왓츠앱, 메신저, 오큘러스 등 계열 서비스 전체가 순식간에 접속 불가 상태에 빠졌다. 클라우드플레어 등 외부 네트워크 감시 업체들은 이 시점부터 페이스북의 IP 대역이 전 세계 라우팅 테이블에서 사라진 것을 실시간으로 포착했다. 이는 단일 기업 장애로는 이례적으로 큰 규모의 인터넷 인프라 이상 현상이었다.

  2. 전 세계 DNS 캐시 만료로 접속 완전 두절, 다운디텍터 역대 최다 신고

    BGP 경로가 사라진 지 약 10분 뒤인 오후 3시 50분(UTC)부터는 전 세계 주요 DNS 리졸버에 남아 있던 페이스북 도메인의 캐시 기록마저 만료되기 시작하면서 접속 불가 상태가 사실상 완전한 것으로 확정됐다. 네트워크 장애 감시 서비스 다운디텍터에는 페이스북·인스타그램·왓츠앱 관련 장애 신고가 1000만 건 넘게 폭주하며 해당 서비스 역사상 가장 많은 신고 건수를 기록했다. 수십억 명에 달하는 이용자가 갑작스럽게 메신저 기반 소통 수단을 잃으면서 특히 왓츠앱 의존도가 높은 중남미·아시아·아프리카 일부 지역에서는 일상적인 연락과 소규모 자영업 거래에도 차질이 빚어졌다. 페이스북은 공식 트위터 계정 등 자사 채널이 아닌 외부 경로를 통해서만 장애 사실을 알릴 수 있는 역설적 상황에 놓였다. 이번 장애는 특정 서비스에 대한 과도한 의존이 가져올 수 있는 위험성을 재확인시킨 사례로 지목됐다.

  3. 직원들마저 사내 출입증 먹통…본사 시스템까지 마비

    장애가 데이터센터 간 연결 자체를 끊어버린 탓에 페이스북 내부 직원들도 사내 이메일과 협업 도구는 물론, 건물 출입에 쓰이는 전자 배지 시스템까지 작동하지 않는 초유의 상황을 겪었다고 뉴욕타임스 등이 보도했다. 일부 직원은 사무실이나 회의실에 아예 들어가지 못했고, 원격 복구 작업을 지휘해야 할 엔지니어들조차 필요한 내부 시스템에 접근하는 데 어려움을 겪은 것으로 전해졌다. 이는 장애 복구 작업 자체를 지연시키는 요인으로 작용했으며, 물리적 인프라와 디지털 인증 시스템이 서로 지나치게 얽혀 있을 때 발생할 수 있는 취약점을 보여줬다. 결국 일부 엔지니어들이 데이터센터 현장에 직접 접근해 장비를 재설정하는 방식으로 복구를 진행해야 했다는 후문도 전해졌다. 이 일화는 이후 대형 빅테크 기업들의 재해복구 체계 점검 논의에서 자주 인용됐다.

  4. 약 6시간 만에 서비스 복구 시작

    페이스북은 오후 9시(UTC) 직전 데이터센터에 대한 BGP 경로 재공지를 시작했고, 오후 9시 5분께 도메인 이름이 다시 정상적으로 해석되면서 서비스가 서서히 복구되기 시작했다. 장애가 시작된 오후 3시 39분부터 계산하면 총 6시간 가까이 페이스북과 인스타그램, 왓츠앱이 전 세계에서 동시에 접속 불가 상태였던 셈이다. 복구 이후에도 갑작스럽게 몰린 트래픽으로 인해 일부 지역에서는 서비스 속도 저하나 재접속 지연이 한동안 이어졌다. 이용자들은 오랜만에 정상화된 메신저와 피드를 통해 서로의 안부를 확인하며 장애 상황을 공유했다. 이번 장애는 단일 기술적 실수가 얼마나 광범위한 사회적 파장을 일으킬 수 있는지 보여준 사례로 기록됐다.

  5. 메타, 원인은 '유지보수 명령 실수'라고 공식 설명

    페이스북 엔지니어링팀은 10월 5일 공식 블로그를 통해 장애의 기술적 원인을 상세히 공개했다. 이에 따르면 백본 라우터의 전 세계 용량을 점검하려는 정기 명령이 감사 도구의 버그로 인해 의도한 범위를 넘어 백본 연결 전체를 사실상 초기화하는 명령으로 잘못 실행됐다. 이 때문에 페이스북의 데이터센터들이 서로 통신할 방법을 잃었고, 이 연쇄 효과가 DNS 서버 접근 불가로까지 이어지며 전체 서비스 마비로 번졌다는 설명이었다. 회사는 해킹이나 외부 공격에 의한 것이 아니라 내부 시스템 운영 실수였다는 점을 분명히 했다. 이번 사고를 계기로 메타는 향후 유사한 대규모 자체 차단을 막기 위한 점검 절차와 안전장치를 강화하겠다고 밝혔다.

  6. 주가 5% 급락, 저커버그 개인 재산 60억 달러 증발

    장애가 이어지던 10월 4일 뉴욕 증시에서 페이스북 주가는 약 4.9% 하락해 326.23달러로 마감했다. 이 하루 낙폭만으로 시가총액 약 470억 달러가 사라졌고, 지분을 대량 보유한 마크 저커버그 최고경영자의 개인 자산도 약 60억 달러 가까이 줄어 포브스 세계 부자 순위에서 한 계단 밀려났다. 하필 같은 시기 내부고발자 프랜시스 하우건이 CBS '60분'에 출연해 회사가 이용자 안전보다 이익을 앞세웠다고 폭로했고, 이튿날인 10월 5일에는 미국 상원 청문회 증언이 예정돼 있었다. 서비스 장애와 내부고발이 겹치면서 시장에서는 메타의 규제 리스크가 동시에 부각됐다. 단일 기업의 인프라 장애가 기업 가치와 경영진 자산에 어느 정도로 직결되는지를 보여준 사례로 회자됐다.

3. 같이 보기[편집]

336
알리익스프레스 프로모션 배너

자주 묻는 질문

페이스북·인스타그램·왓츠앱 전 세계 6시간 동시 다운 사태, 어떤 사건인가요?
2021년 10월 페이스북의 네트워크 설정 오류로 페이스북·인스타그램·왓츠앱·메신저가 전 세계에서 약 6시간 동안 동시에 먹통이 되며 수십억 이용자가 피해를 본 대규모 IT 장애 사건이다.
페이스북·인스타그램·왓츠앱 전 세계 6시간 동시 다운 사태, 언제 일어났나요?
2021-10-04부터 2021-10-05까지 이어진 사건입니다.
페이스북·인스타그램·왓츠앱 전 세계 6시간 동시 다운 사태, 지금 상태는 어떤가요?
종결된 사건입니다. 2021-10-05에 마무리되었습니다.

개선 제안

이 문서에 대한 개선을 제안할 수 있어요. 제안은 관리자 검토 후 반영됩니다.

개선 제안하기