기사 원문 - https://www.tomshardware.com/tech-industry/data-centers/elon-musks-spacexai-to-add-another-660-000-ai-gpus-this-year-nearing-a-total-of-1-44-million-in-operation-firm-is-building-1-2-gigawatt-power-plant-to-bring-systems-fully-online
 

일론 머스크 가 슈퍼컴퓨터 콜로서스를 100만 개 이상의 GPU로 확장 하겠다는 계획을 발표한 지 거의 2년 만에 마침내 최종 목표가 눈앞에 다가왔습니다 . 머스크는 X 포럼 에서 엔비디아 GB300 GPU 22만 개가 다음 주까지 가동될 예정이며, 11월에는 22만 개가 추가로 가동될 것이라고 밝혔습니다. 그는 또한 "운이 좋다면" 12월 말까지 22만 개가 더 가동될 것이라고 덧붙였습니다.

https://x.com/elonmusk/status/2103329761690865846

이 수치는 콜로서스 2에서 이미 가동 중인 11만 개의 GB200 및 44만 개의 GB300 GPU와 콜로서스 1에 있는 15만 개의 H100, 5만 개의 H200, 3만 개의 GB200 GPU에 더해집니다. 이렇게 되면 SpaceXAI의 GB300 GPU는 110만 개, 가동 중인 총 GPU는 144만 개에 달하게 됩니다. 이는 특히 경쟁사보다 몇 년 뒤처진 회사라는 점을 고려할 때 매우 놀라운 성과입니다. SpaceXAI는 설립된 지 3년밖에 되지 않았지만, Anthropic과 OpenAI는 각각 6년과 10년의 역사를 가지고 있습니다. 흥미로운 점은 Hopper와 Blackwell GPU가 혼합된 콜로서스 1 사이트는 Grok 학습에는 비효율적이어서 머스크는 추론 작업을 위해 Anthropic에 임대해 주었다는 것 입니다 . 반면, 콜로서스 2는 블랙웰 GPU만 사용하기 때문에 병목 현상이 발생하지 않습니다.

일론 머스크가 젠슨 황에게 GPU를 달라고 간절히 요청했지만 , 현재 GPU 확보 자체가 가장 어려운 부분은 아닙니다. 데이터센터 구축에 있어 가장 큰 문제 중 하나는 전력인데, SpaceXAI는 자체 발전 시스템을 도입하여 이 문제를 해결했습니다. 하지만 이로 인해 인근 주민들과 논란이 일었고, 허가 없이 가스 터빈을 가동했다는 이유로 소송 까지 이어졌습니다 . SpaceXAI는 자체 1.2GW 발전소가 가동을 시작하는 1년 동안 가스 터빈을 단계적으로 철거하겠다고 약속 했습니다.

단일 사이트에서 백만 개 이상의 GPU를 운영하는 것은 놀라운 성과이지만, SpaceXAI만 이 목표를 추구하는 것은 아닙니다. 브로드컴은 2024년에 2027년까지 이 목표를 달성하려는 하이퍼스케일 고객사가 세 곳 있다고 밝혔 지만, 구체적인 고객사는 언급하지 않았습니다. 일론 머스크에게 백만 개의 GPU 목표는 시작에 불과합니다. 그는 SpaceXAI 의 데이터 센터 용량을 2027년까지 7배로 늘릴 것이며, 2030년까지 H100급 GPU 5천만 개를 목표로 하고 있다고 말했습니다 . 이러한 데이터 센터는 지상에만 국한되지 않을 것입니다. SpaceX는 백만 개의 위성을 탑재한 궤도 데이터 센터 시스템을 구축할 계획인데 , 젠슨 황 CEO는 현재로서는 "꿈"에 불과하다고 말했지만 말입니다 .