AMD, yapay zeka alanındaki iddialı yeni ürünü Helios ile NVIDIA'ya meydan okumaya hazırlanıyor. Raporlara göre, AMD Helios rackscale çözümünü, rakibi NVIDIA'nın ikinci nesil Rubin'inden önemli ölçüde daha yüksek bir fiyatla piyasaya sürecek. Bu cüretkar fiyatlandırma stratejisinin arkasında, müşterilerin bu premium fiyatı ödemeye istekli olacağına dair güçlü bir inanç yatıyor. Hatta ilkconfirmed müşteri olarak Microsoft'u ikna etmeyi başardıkları gelen bilgiler arasında.
Helios'un Fiyatlandırması ve NVIDIA Rubin ile Karşılaştırması
Analistlerin tahminlerine göre, AMD Helios'un sunucu başına 5 milyon ile 5.5 milyon dolar arasında bir fiyat etiketine sahip olması bekleniyor. Bu rakam, NVIDIA'nın ikinci nesil Rubin rack çözümünün tahmini 3.5 milyon ile 4 milyon dolarlık perakende satış fiyatının yaklaşık %40 üzerinde bir artış anlamına geliyor.
Helios Neler Sunuyor?
Helios, AMD'nin yapay zeka iş yükleri için geliştirdiği ilk tam entegre rack seviyesi çözümü olarak öne çıkıyor. Bu çözüm şu bileşenlerden oluşuyor:
- AMD Instinct MI455X GPU'lar
- 6. Nesil AMD EPYC CPU'lar
- AMD Pensando AI Ağ Arayüz Kartları (NIC)
- AMD Pensando DPU
- AMD Infinity Fabric
- AMD ROCm Yazılım Yığını
AMD'nin MI400 serisi GPU'ları, en yeni CDNA 5 mimarisini temel alıyor. Bu GPU'lar, artırılmış HBM4 kapasitesi ve bant genişliği sunarken, daha yüksek verimlilikle genişletilmiş yapay zeka formatları için destek sağlıyor. Helios'a güç veren MI455X GPU, 40 PFLOPs FP4 ve 20 PFLOPs FP8 hesaplama gücü sunuyor. Karşılaştırma yapmak gerekirse, bir NVIDIA Rubin GPU 50 PFLOPs FP4 ve 17.5 PFLOPs FP8 hesaplama gücü sunuyor. MI455X GPU, 19.6 TB/s bant genişliğine sahip 432 GB HBM4 kullanırken, NVIDIA Rubin 22 TB/s bant genişliğine sahip 288 GB HBM4 kullanıyor.
Altıncı nesil AMD EPYC CPU'lar, kod adı "Venice", yeni Zen 6 çekirdek mimarisine dayanıyor ve TSMC'nin 2nm üretim teknolojisiyle üretiliyor. Bu CPU'lar, 8 büyük işlem çekirdeği ve 2 daha büyük G/Ç çekirdeği ile 256 çekirdek ve 512 iş parçacığına kadar destek sunuyor.
AMD Pensando "Vulcano" 800 AI NIC, 800 Gbps yüksek performanslı bir ağ anahtarı olup, 800 Gbps Ethernet ağ verimliliği sağlıyor. Bu NIC, tam donanım ve yazılım programlanabilirliği ile GPU başına 2.4 Tbps ölçeklenebilir bant genişliği sunabilen tek NIC olma özelliğini taşıyor.
Son olarak, AMD Pensando DPU, yapay zeka sunucularını kurumsal ağlara bağlıyor. Ağ, güvenlik ve depolama yüklerini azaltarak yapay zeka sunucularının verimliliğini artırıyor. Her Salina DPU, ağ, güvenlik ve depolama için 16 adet Arm N1 çekirdeği barındırıyor.
Bu rakamların yalnızca tahminler olduğunu ve maliyetlerin yanı sıra rekabetçi fiyatlandırma dinamiklerinin de dikkate alınması gerektiğini belirtmekte fayda var.
Microsoft'un Helios'u Tercihi
Microsoft'un Helios rack çözümünü Azure AI hizmetlerinde kullanmak üzere kesin onay verdiği bildirildi. AMD'nin ayrıca OpenAI, META, Oracle, HPE, TCS, Celestica, Nutanix ve ABD Enerji Bakanlığı gibi büyük oyuncuları da müşteri olarak ikna ettiği gelen bilgiler arasında.