마이크로소프트 Azure 서비스 중단: 무슨 일이 일어났고 어떻게 해결되었나요?

마이크로소프트의 Azure 클라우드 컴퓨팅 플랫폼에서 수요일에 대규모 서비스 중단 사태가 발생했습니다. 이 장애는 10월 29일 15시 45분(UTC)부터 10월 30일 0시 5분(UTC) 사이에 발생했습니다. Azure Front Door(AFD)를 사용하는 마이크로소프트 서비스 (App Service, Media Services, Microsoft Purview, Plus 등)가 영향을 받았습니다.

마이크로소프트 Azure 서비스 중단: 무슨 일이 일어났고 어떻게 해결되었나요?

게다가 Azure는 세계 3대 클라우드 인프라 제공업체 중 하나이기 때문에 수많은 웹사이트에서 서비스 중단이 발생했습니다. 사용자들은 Downdetector에 Microsoft 365 , Minecraft, Xbox 및 관련 웹사이트에서도 문제가 발생했다고 보고했습니다.

Azure의 초기 사후 검토 에 따르면 , 이 문제는 "의도치 않은 테넌트 구성 변경"으로 인해 발생했습니다. 이로 인해 여러 AFD 노드가 제대로 로드되지 않아 지연, 연결 오류 및 시간 초과가 발생했습니다. 본질적으로 잘못된 테넌트 구성이 연쇄 반응을 일으켜 장애가 발생한 것입니다.

이를 해결하기 위해 Azure는 모든 고객 구성 변경을 일시적으로 차단하고 최신 안정 버전을 출시했습니다.

해당 사태 발생 당시, 마이크로소프트 365 상태Azure 지원 공식 계정에서 X에 대한 업데이트를 제공했습니다. 한동안 마이크로소프트 서비스 상태 페이지도 접속이 불가능했습니다. 10월 29일 18시 30분(UTC)경, 전역적으로 수정된 구성이 단계적으로 배포 및 적용되었습니다.

Microsoft 365 Status X 계정은 다음과 같이 밝혔습니다. "이 문제를 해결하기 위해 영향을 받는 인프라의 이전 정상 구성으로 복원하고 있습니다. 또한 정상적인 인프라 전체에 트래픽을 분산시켜 영향을 신속하게 완화하기 위한 노력도 병행하고 있습니다."

마지막으로 Microsoft는 2025년 10월 30일 00:05 UTC에 AFD로 인한 고객 영향이 완화되었음을 확인했습니다. 최종 사후 검토 보고서가 14일 이내에 발표되면 더 자세한 내용을 확인할 수 있습니다. Azure 서비스 상태 알림은 이메일, SMS 및 웹 알림을 통해 사용자에게 제공됩니다.

안타깝게도 최근 이러한 서비스 중단 사태는 이번이 처음이 아닙니다. 불과 9일 전에도 아마존 웹 서비스(AWS)의 대규모 장애로 인해 수많은 웹사이트와 서비스가 접속 불가 상태에 빠졌습니다. AWS 서비스 상태 페이지에 따르면 , 이 장애의 원인은 도메인 이름 시스템(DNS) 확인 문제였습니다.

이는 인터넷처럼 광범위하고 세계적인 것조차도 취약할 수 있음을 보여줍니다. AWS, 마이크로소프트 애저, 구글 서비스는 대부분의 인프라를 지탱하는 세 개의 거대 클라우드 컴퓨팅 업체입니다. 이들 중 하나라도 장애를 일으킨다면 그 영향은 엄청날 것입니다.

아마존은 2025년 2분기 클라우드 컴퓨팅 시장에서 30%의 점유율 로 선두를 차지할 것으로 예상됩니다 . Azure는 약 20%의 점유율로 2위를 기록하고 있으며, 구글 서비스는 13%의 점유율을 보이고 있습니다. 최근 발생한 서비스 중단 사태로 인해 수많은 사용자와 시스템이 이러한 시장 변화의 영향을 받을 수 있습니다.

댓글이 닫혀있다.