AMD, MLPerf Inference v6.1 için 512 adet MI355X GPU’dan oluşan bir kümeyle test sonuçlarını sundu; bu girişim aynı silikon üzerinde döngü içinde yapılan iyileştirmelerin uygulandığını gösteriyor.

AMD’nin taktiği ne?
AMD’nin MI355X düzeni çiplet tabanlı; her hızlandırıcı 8 adet XCD (Accelerator Complex Die) içeriyor ve her birimde 288 GB HBM3 bellek bulunuyor. Oracle’ın belgeleri ise MI355X tabanlı sistemlerin yaygın bir konfigürasyonunun 8 x MI355X olduğunu ve önerilen işletim sistemlerinin Oracle Linux 9+ veya Ubuntu 22.04+ olduğunu doğruluyor. Bu bilgiler, kümelemenin hem donanım hem de yazılım uyumluluğu açısından planlı olduğunu gösteriyor.
NVIDIA ve Intel cephesinde neler var?
NVIDIA, Blackwell mimarili GB200 ve GB300 NVL72 sistemleriyle v6.1 sonuçları sundu; aynı ölçekte GB300'ün eğitmede GB200’ye kıyasla %60’a kadar daha hızlı olduğu bildirildi. Ayrıca NVIDIA, Vera Rubin NVL72 için DeepSeek-R1 gibi zorlu testlerde ön izleme sonuçları teslim etti; bu sistem pre-release aşamasında.
Diğer katılımcılar ve pratik notlar
Intel de MLPerf v6.1’e Arc Pro B70 GPU’ları ve Xeon 6 işlemcileriyle katıldı. Arc Pro B70, DeepSeek-R1’de RTX 5090D’yi geride bırakarak 2000 token/saniye üzeri performans gösterdi; önceki sürümde ise %80’e varan artışlar raporlanmıştı. Kenarda, NVIDIA Jetson AGX Thor’un Edge Agentic testi TensorRT Edge-LLM ile Qwen3.6-27B’de 6.4x hız kazancı sundu.
Bu sonuçlar MLPerf gönderimlerinin anlık performans kesitleri olduğunu ve test koşullarının teslim edilen raporlara bağlı kaldığını hatırlatıyor; Vera Rubin hâlâ ön gösterim aşamasında, MI355X konfigürasyonları ise hem büyük kümelerde hem de daha küçük 8-GPU kurulumlarında dokümante edilmiş durumda.
Yorumlar(0)