Cloudflare의 서비스 중단으로 X와 ChatGPT가 다운되어 일련의 오류가 발생했습니다.

  • Cloudflare 서비스 중단으로 인해 X, ChatGPT 및 기타 서비스에 전 세계적인 중단이 발생했습니다.
  • 사건은 스페인에서 정오에 시작되었고, 회사는 그 직후에 완화 조치에 착수했습니다.
  • 500 오류로 인해 Cloudflare 대시보드와 API가 영향을 받았습니다. 일부 트래픽은 가끔씩 오류가 발생했지만 계속 흐릅니다.
  • 스페인과 유럽에 상당한 피해가 발생했으며, 아직 공격 원인을 조사 중이며 특정 타깃을 겨냥한 공격은 나타나지 않았습니다.

Cloudflare 서비스 중단으로 인한 서비스 중단

화요일, 클라우드플레어 네트워크의 광범위한 장애로 인해 전 세계적으로 인터넷 접속이 마비되면서 수백만 명의 사용자가 X , ChatGPT 등 인기 서비스에 접속할 수 없게 되었습니다 . 스페인 본토 시간으로 정오 무렵 발생한 이 사태는 인터넷을 지탱하는 기반 시설의 상호 연결성을 여실히 보여주었습니다.

CDN 및 사이버 보안 분야 의 주요 업체인 미국 기업은 자사 제어판과 API에서 발생한 500건의 오류 및 서비스 중단 사태 를 조사 중이며 단계적 복구를 진행하고 있다고 밝혔습니다. 스페인을 비롯한 유럽 전역에서 유사한 장애 보고가 잇따르며 소셜 미디어, 디지털 엔터테인먼트, 그리고 금융 서비스 등 다양한 분야에 영향을 미쳤습니다.

사건의 연대기

첫 번째 경고는 정오 12시 30분경(반도 시간) 에 등록되었으며 , 문제는 오후 13시경에 최고조에 달했습니다. 클라우드플레어는 오전 00시 직전인 정오 12 시 48 분경에 상황을 인지하고 완화 조치를 적용하기 시작했습니다. 오후 13시 15분경 에는 많은 서비스가 복구되기 시작했지만, 일부 환경에서는 잔여 장애가 지속되었습니다.

회사 관계자에 따르면 오전 11시 20 분경 한 서비스에서 비정상적인 트래픽 급증이 감지되었으며 , 이로 인해 네트워크의 여러 구성 요소에서 심각한 오류가 발생했습니다. 대부분의 트래픽은 계속 흐르긴 했지만, 이러한 성능 저하로 인해 자주 사용되는 애플리케이션에 상당한 장애가 발생했습니다.

글로벌 서비스 중단으로 인해 영향을 받는 서비스

큰 영향을 받는 서비스

이번 공격은 광범위한 영향을 미쳐 X(구 트위터)ChatGPT를 비롯한 여러 주요 플랫폼에까지 영향을 미쳤습니다 . 콘텐츠 제작 및 저장 도구, 온라인 게임, 그리고 트래픽이 많은 일부 기업 웹사이트에서도 유사한 사례가 보고되면서 상당한 연쇄 효과가 발생했습니다.

  • 소셜 네트워크와 커뮤니케이션: X, 나 Mename 나를 그리고 모니터링 포털 Downdetector 오류가 발생하거나 로딩 시간이 느리다는 문제가 있었습니다.
  • 인공지능과 생산성: ChatGPT, Canva, 드롭 박스 일부 비즈니스 서비스는 간헐적으로 중단되었습니다.
  • 금융 및 서비스: 문제가 보고되었습니다. 코인베이스 및 기업 웹사이트 등 무디스사용자는 다음과 같은 엔터티에서 특정 어려움을 언급했습니다. CaixaBank.
  • 여가 및 비디오 게임: 리그 오브 레전드 및 엔터테인먼트 앱과 같은 Grindr 그들은 방해를 받았습니다.
  • 운송 및 통신: 사고 뉴저지 교통 그리고 운영자의 일시적인 중단이나 성능 저하 등 Movistar.

고객에게 미치는 영향 외에도 이번 사고로 클라우드플레어의 내부 서비스 도 영향을 받았습니다. 피해 완화 노력의 일환으로 클라우드플레어는 네트워크 안정화를 위해 런던의 WARP 서비스를 일시적으로 중단한 후 오류 수준이 정상으로 돌아오면 다시 활성화하는 등의 구체적인 조치를 발표했습니다.

무엇이 잘못되었고 무엇이 알려졌는가

회사 측은 초기 발표에서 이번 사건을 내부 서비스 저하 로 분류 하고 복구 속도를 높이기 위해 변경 사항을 적용하고 있다고 밝혔습니다. 현재로서는 외부 공격의 증거는 없으며 , 운영상의 가설은 자체 인프라 내부의 문제로 추정되고 있으며, 이에 대한 분석이 진행 중입니다.

이번 사태가 최고조에 달했을 때, 사용자들은 광범위한 500 오류 와 콘텐츠 로딩 실패는 물론, 클라우드 플레어 대시보드 및 API 사용에도 문제를 겪었습니다. 클라우드플레어는 자사 상태 페이지( cloudflarestatus.com )에 업데이트를 게시하고 블로그( blog.cloudflare.com ) 에 심층 분석을 게재할 예정이라고 밝혔습니다.

스페인과 유럽에 미치는 영향

스페인에서 발생한 대부분의 장애 경보는 근무 시간과 데스크톱 디지털 사용량이 가장 많은 이른 오후에 집중되었습니다. 개인 사용자뿐 아니라 기업 도 영향을 받았으며 , 소셜 미디어, AI 플랫폼, 은행 및 통신 서비스에서 간헐적인 장애가 발생했습니다.

클라우드플레어를 CDN 및 보안 계층으로 사용하는 유럽 기업들의 경우 , 이번 사태로 인해 지연 시간 급증, 부분적인 서비스 중단, 라우팅 오류가 발생했으며, IT 팀은 회사 전체 네트워크에서 복구가 진행되는 동안 비상 대책을 시행했습니다.

재설정 및 다음 단계

클라우드플레어는 변경 사항 구현 후 오류 발생률이 감소하고 있으며 , 복구가 네트워크 전반으로 확산되고 있다고 보고했습니다 . 최우선 과제는 트래픽 안정성을 확보하는 것이 었고 , 그 다음으로 유사한 사태 재발을 방지하기 위한 철저한 근본 원인 분석이 진행될 예정이었습니다.

이번 사건은 대규모 인프라 제공업체에 대한 의존도 에 대한 논쟁을 다시 불러일으켰습니다 . 최근 AWSAzure 에서 발생한 장애 사태 에 이어 발생한 이번 사건은 수백만 개의 서비스가 동일한 핵심 계층에 의존하는 상황에서 국지적인 장애가 얼마나 광범위한 파급 효과를 가져올 수 있는지를 보여줍니다.

이번 시스템 장애는 단 하나의 취약한 연결 고리가 여러 분야에 동시에 파급 효과를 미칠 수 있음을 명확히 보여주었습니다 . 대부분의 플랫폼이 이제 정상적으로 운영됨에 따라, 모든 관심은 무엇이 잘못되었는지, 어떻게 문제를 해결했는지 , 그리고 디지털 생태계의 복원력을 강화하기 위해 어떤 변화가 시행될 것인지를 상세히 기술한 보고서에 집중되고 있습니다 .

Amazon 클라우드 중단으로 애플리케이션과 서비스에 영향
관련 기사 :
Amazon Cloud 서비스 중단: AWS 서비스 중단으로 앱과 웹사이트가 마비됨

Google에서 선호하는 검색 엔진으로 추가