Microsoft, yapay zeka altyapısını genişletirken pazarın iki büyük rakibini birden tercih etme yoluna gidiyor. Şirket, 20 Temmuz'da yayımladığı blog yazısında Azure AI ve HPC altyapısına AMD'nin en gelişmiş sistemlerini dahil ettiğini duyurdu. Bu karar, AMD Helios rack sistemlerinin tahmini maliyetinin NVIDIA Vera Rubin NVL72'ye kıyasla yaklaşık %40-57 daha yüksek olduğu iddialarına rağmen alındı.

Neden tek tedarikçi yetmiyor?
Microsoft'un duyurusunda dikkat çeken ifade şu: "Yapay zeka iş yükleri, tek bir altyapı yaklaşımının destekleyebileceğinden daha hızlı ölçekleniyor." Şirket, daha fazla model, yeni ajan odaklı iş yükleri ve patlayan işlem talebinin yığında uzmanlaşma gerektirdiğini vurguluyor. Bu açıklama, bulut devinin neden maliyet avantajına sahip NVIDIA Vera Rubin'e yönelmek yerine her iki ekosistemi de sürdürdüğünü açıklıyor.
AMD Helios Rack, Meta'nın Open Rack Wide standardına dayanan bir rack-scale AI referans tasarımı. Sistem 72 adet AMD Instinct MI455X GPU, AMD EPYC işlemci ve AMD Pensando DPU birleşiyor. NVIDIA Vera Rubin NVL72 ise üçüncü nesil MGX NVL72 rack mimarisiyle öne çıkıyor ve AI eğitiminde dörtte bir GPU, çıkarımda ise onda bir token maliyetiyle önceki nesil Blackwell'i hedef alıyor.
Fiyat iddiası ve belirsizlikler
AMD Helios'un rack başına 5-5,5 milyon dolar, NVIDIA Vera Rubin'in ise 3,5-4 milyon dolar bandında fiyatlandığı yönündeki tahminler analist kaynaklarına dayanıyor. Ancak bu rakamlar resmî kaynaklardan doğrulanmış değil. Dahası, NVIDIA Vera Rubin için 7,8 milyon dolar toplam sistem maliyeti ve bunun 2 milyon dolarının belleğe gittiğine dair ayrı bir iddia mevcut. Bu çelişki, farklı konfigürasyonların veya maliyet hesaplama yöntemlerinin söz konusu olduğunu düşündürüyor.
NVIDIA tarafında Vera Rubin NVL72 üretimi CoreWeave, Google Cloud, Microsoft Azure ve Oracle Cloud Infrastructure'da devam ediyor. Microsoft'un hem NVIDIA hem AMD sistemlerini birden fazla ortakla birlikte konuşlandırması, çift tedarikçi stratejisinin somut bir göstergesi.
Performans vaatleri ne düzeyde?
NVIDIA Vera Rubin platformu, çıkarım token maliyetinde 10 kata kadar azalma ve MoE modellerini eğitmek için gereken GPU sayısında 4 kata kadar azalma vaat ediyor. AMD tarafından Helios için benzer performans iddiaları sunan resmî bir kaynak bulunmuyor; teknik karşılaştırma bağımsız incelemelere kalıyor.
AMD Helios'un daha yüksek maliyetine rağmen tercih edileceği yönündeki iddia ise pazarlama tonu taşıyan bir analist yorumuna dayanıyor. Bağımsız müşteri onayı veya sipariş verisi şu an mevcut değil.
Yorumlar(0)