ChatGPT·Claude·Grok 동시 접속 장애… SpaceX 멤피스 컴퓨팅 센터 정전이 원인?
AI 인프라가 소수 데이터센터에 집중된 단일 실패점 리스크 노출, 다중 벤더·리전 이중화 검토 필요.
요약
최근 ChatGPT, Claude, Grok 등 주요 AI 서비스가 같은 시간대에 동시 장애를 겪는 사태가 발생했다. 이번 장애의 원인은 SpaceX의 멤피스 데이터센터 전력 문제로 확인되었으며, 해당 시설은 22만 개의 Nvidia 칩을 활용한 300메가와트 규모의 컴퓨팅 허브다. 특히 Anthropic은 올해 초 SpaceX와 컴퓨팅 계약을 체결해 해당 시설을 이용 중이었으며, 이번 사고로 Claude와 관련 개발 도구들이 3시간 동안 마비되었다. 각 AI 기업은 독립적인 인프라를 구축하고 있다고 홍보해왔으나, 이번 사건을 통해 특정 데이터센터에 대한 높은 의존도가 드러났다. OpenAI와 Anthropic은 공식적으로 구체적인 장애 원인을 밝히지 않았으나, SpaceX는 자사 컴퓨팅 파트너들에 대한 영향을 인정하며 상황의 심각성을 시사했다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: Okay this is interesting. ChatGPT, Claude, and Grok all went down within the same hour yesterday. The reason is bigger than a regu
원문 보기 ↗