- Cloudflare 글로벌 네트워크에서 내부 서비스 성능 저하가 발생해 여러 서비스가 간헐적으로 영향을 받음
- Access, Bot Management, CDN/Cache, Dashboard, Firewall, Network, WARP, Workers 등 주요 서비스가 일시적으로 장애를 겪음
- 엔지니어링 팀이 문제를 식별하고 수정 작업을 진행했으며, WARP와 Access 서비스가 먼저 복구됨
- 이후 전 세계적으로 오류율과 지연이 점차 정상 수준으로 회복되고, 대시보드 서비스도 복원됨
- 현재 모든 서비스가 정상적으로 운영 중이며, 사건은 완전히 해결된 상태
사건 개요
- Cloudflare는 내부 서비스 성능 저하(Internal Service Degradation) 를 겪으며 일부 서비스가 간헐적으로 중단됨
- 영향을 받은 서비스에는 Access, Bot Management, CDN/Cache, Dashboard, Firewall, Network, WARP, Workers 등이 포함됨
- 회사는 즉시 복구 작업에 착수하고, 문제 해결 진행 상황을 지속적으로 업데이트함
문제 식별 및 초기 대응
- Cloudflare는 문제를 조사 중(Investigating) 단계에서 내부 서비스 저하를 확인함
- 일부 고객이 간헐적인 오류와 지연을 경험함
- 엔지니어링 팀이 원인 분석과 복구 작업을 병행함
- 이후 문제 원인을 식별(Identified) 하고 수정 작업을 시작함
- 수정 도중 런던 지역의 WARP 접속이 일시적으로 비활성화되어, 해당 지역 사용자는 인터넷 연결 실패를 경험함
서비스 복구 진행
- 수정 작업 후 Access와 WARP 서비스가 먼저 복구되어 오류율이 사고 이전 수준으로 돌아감
- 런던 지역의 WARP 접속이 재활성화됨
- 이후 Application Services 고객 대상 서비스 복원 작업이 이어짐
- 대시보드 서비스 복구를 위한 변경 사항이 배포됨
- 여전히 일부 고객이 로그인 또는 대시보드 사용 문제를 겪었으나, 추가 수정으로 해결됨
네트워크 전반의 안정화
- 전 세계적으로 오류율과 지연(latency) 이 점차 감소하며 정상 수준으로 회복됨
- Bot Management의 점수 계산(bot scores) 이 일시적으로 영향을 받았으나, 복구 과정에서 정상화됨
- 엔지니어링 팀은 남은 오류를 제거하고 전체 네트워크 복구를 가속화함
- 이후 모든 서비스가 정상적으로 작동하며, 오류율과 지연이 완전히 정상화됨
사건 종료 및 후속 조치
- Cloudflare는 모든 서비스가 정상 운영 중임을 확인하고 사건을 종료함
- 현재 추가적인 구성 변경은 없으며, 플랫폼을 면밀히 모니터링 중
- 사고 원인에 대한 사후 조사(post-incident investigation) 가 진행 중이며, 결과는 추후 공개 예정
- 이번 장애는 글로벌 네트워크 전반에 영향을 미친 사건으로 기록됨