Haberler

SpaceXAI Colossus, Nvidia Hızlandırıcı Sayısını 1 Milyonun Üzerine Taşımaya Hazırlanıyor

Elon Musk’ın xAI şirketi, Memphis çevresindeki Colossus yapay zekâ altyapısında Nvidia hızlandırıcılarının toplam sayısını 1 milyonun üzerine çıkarmaya hazırlanıyor. 25 Eylül 2026 tarihli plana göre Colossus 2’deki 550 bin Nvidia hızlandırıcısına ek olarak 220 bin GB300 çipinin ekim başında, 220 bin GB300’ün kasım ayında devreye alınması planlanıyor. Aralık sonunda üçüncü 220 binlik grubun da çalışması hâlinde Colossus 2 yaklaşık 1,21 milyon hızlandırıcıya ulaşırken Colossus 1 ile birlikte kampüsün toplam kapasitesi yaklaşık 1,44 milyona çıkabilecek.

Colossus 2 Nvidia Hızlandırıcı Sayısını Hızla Artırıyor

Memphis bölgesindeki Colossus 2 kampüsünde şu anda 110 bin Nvidia GB200 ile 440 bin Nvidia GB300 olmak üzere 550 bin hızlandırıcı bulunuyor. Elon Musk’ın 25 Eylül’de yaptığı açıklamaya göre şirket, ekim ayının ilk günlerinde 220 bin GB300’ü daha devreye almayı planlıyor. Nvidia GB300 hızlandırıcılarından oluşan ikinci 220 binlik grubun ise kasım ayında sisteme katılması bekleniyor.

Colossus 2’nin mevcut 550 binlik kapasitesi üzerine eklenmesi planlanan üç parti, toplam 660 bin yeni GB300 hızlandırıcısı anlamına geliyor. Aralık sonundaki son parti için Musk kesin bir takvim vermek yerine koşullu bir ifade kullanırken gerçekleşmesi durumunda Colossus 2’nin toplamı 1,21 milyon hızlandırıcıya ulaşacak.

Colossus 1 tarafında ise xAI’nin güncellediği donanım dağılımı 150 bin H100, 50 bin H200 ile 30 bin GB200 şeklinde sıralanıyor. Söz konusu dağılım Colossus 1 için toplam 230 bin Nvidia hızlandırıcıya karşılık gelirken iki tesis birlikte değerlendirildiğinde ilk 220 bin GB300 grubunun devreye girmesiyle toplam sayı yaklaşık 1 milyona ulaşacak.

Nvidia’nın GB200 ile GB300 platformları, Colossus genişlemesinin yeni nesil hesaplama katmanını oluşturuyor. GB200, Nvidia’nın Blackwell mimarisini Grace CPU ile birleştiren bir süperçip platformu olarak konumlanırken GB300, Blackwell ailesinin daha yeni nesil yapay zekâ hızlandırma platformunu temsil ediyor.

xAI’nin ilk Colossus kümesi ise daha önce Hopper mimarisindeki H100 hızlandırıcıları üzerine kurulmuştu. xAI’nin kendi Colossus sayfasında sistemin 200 bin H100 GPU’ya kadar genişletildiği, tek bir bağlantılı kümede yüksek hızlı ağ ile büyük ölçekli model eğitimi için tasarlandığı belirtiliyor.

Yapay zekâ model eğitimi açısından GPU sayısının artması yalnızca ham işlem gücünü büyütmüyor. Dağıtık eğitim sistemleri, yüz binlerce hızlandırıcı arasında yüksek bant genişlikli iletişim gerektirdiği için ağ altyapısı, bellek bant genişliği, depolama sistemi, soğutma kapasitesi ile elektrik altyapısı toplam performansın önemli parçalarını oluşturuyor. xAI, Colossus için 170 PB/s seviyesinde toplu bellek bant genişliği ile sunucu başına 2,8 Tb/s ağ bant genişliği gibi değerler açıklıyor.

Memphis’teki Colossus genişlemesinde elektrik altyapısı, yeni hızlandırıcıların kurulumu kadar kritik bir darboğaz oluşturuyor. Musk’ın açıkladığı takvim çiplerin fiziksel olarak tesise ulaşmasından çok sistemlere tamamen bağlanıp çalıştırılmasıyla ilgili olduğu için enerji, soğutma, ağ bağlantıları ile veri merkezi kapasitesi takvimin belirleyici unsurları arasında yer alıyor.

Colossus’un ilk aşaması için daha önce yaklaşık 250 MW seviyesinde güç tüketimi bildirilmişti. Büyük GPU kümelerinde elektrik ihtiyacı yalnızca işlemcilerin tüketiminden oluşmadığı için güç dağıtım sistemleri, sıvı soğutma altyapısı, ağ ekipmanları ile depolama donanımları da veri merkezinin toplam enerji yükünü artırıyor.

xAI’nin Memphis kampüsü başlangıçta Grok modellerinin eğitilmesi için geliştirildi. Şirketin Colossus için hazırladığı teknik bilgiler, altyapının büyük ölçekli model eğitimi ile yapay zekâ araştırmalarının temel hesaplama katmanı olarak konumlandırıldığını gösteriyor.

xAI ayrıca 2026 içinde Colossus altyapısındaki hesaplama kapasitesinin Anthropic ile Alphabet’in Google gibi başka yapay zekâ projelerinde de kullanılmaya başladığını açıkladı. Söz konusu kullanım modeli, devasa GPU kümelerinin yalnızca tek bir model ailesinin eğitildiği kapalı sistemler olmaktan çıkarak ticari hesaplama altyapısı olarak da değerlendirildiğini gösteriyor.

Nvidia GB300 sevkiyatlarının planlandığı takvimde gerçekleşmesi, Colossus 2’yi tek başına milyon seviyesine yaklaşan bir yapay zekâ hesaplama kümesine dönüştürecek. Colossus 1’in yaklaşık 230 bin hızlandırıcısı da hesaba katıldığında iki tesisin toplamı, Aralık planının gerçekleşmesi durumunda yaklaşık 1,44 milyon Nvidia hızlandırıcısına ulaşabilecek.

Yapay zekâ sektöründeki yarış açısından söz konusu ölçek, model performansının yalnızca algoritma veya veri kalitesi üzerinden değerlendirilmediğini de gösteriyor. Büyük dil modellerinin eğitiminde hesaplama bütçesi, yüksek hızlı ağ, HBM belleği, enerji kapasitesi ile veri merkezi soğutması birlikte büyüdüğü için GPU tedariki artık daha geniş bir altyapı zincirinin parçası olarak değerlendiriliyor.

Türkiye’deki kurumlar açısından Colossus ölçeğindeki yatırımlar, kurumsal yapay zekâ altyapılarında GPU erişimi, bulut kapasitesi ile enerji maliyetlerinin neden giderek daha fazla önem kazandığını gösteren küresel bir örnek oluşturuyor. Önümüzdeki aylarda Nvidia GB300 sistemlerinin devreye alınma hızı, xAI’nin planladığı kapasiteye gerçekten ne ölçüde ulaşacağını belirlerken veri merkezi yatırımlarının güç ve soğutma tarafındaki sınırları da daha görünür hâle getirecek.

İlgili Makaleler

Bir yanıt yazın

Başa dön tuşu