Ara

OpenAI’den AMD’nin Ortağı Cerebras Çipleri İçin Kritik Övgü: ‘Çıkarım Görevlerinde İnanılmazlar’

AMD, Helios sunucu tabanlı sistemlerinin çıkarım (inference) yeteneklerini artırmak için doğru bir ortak seçmiş görünüyor. OpenAI'den bir araştırmacı, Cerebras'ın Wafer-Scale Engine (Yarım Ölçekli Motor) mimarisine büyük övgüler yağdırdı.

OpenAI Araştırmacısı, Cerebras Çiplerinin Yetenekleri Hakkında Konuştu: 'Çıkarım Hızları Olağanüstü'

Daha önce de belirttiğimiz gibi, Helios, yapay zeka iş yükleri için AMD'nin tam yığın (full-stack) sunucu düzeyindeki ilk çözümüdür ve şu bileşenleri içerir:

  1. AMD Instinct MI455X GPU'lar
  2. 6. Nesil AMD EPYC CPU'lar
  3. AMD Pensando Yapay Zeka Ağ Arayüz Kartları (NIC'ler)
  4. AMD Pensando DPU
  5. AMD Infinity Fabric
  6. AMD ROCm Yazılım Yığını

AMD, yapay zeka iş yükleri için Helios sistemlerinin faydasını daha da artırmak amacıyla Cerebras ile işbirliği yaptı. Bu ortaklık kapsamında Cerebras'ın Wafer-Scale Engine'i, Helios sistemleriyle entegre edilerek son derece hızlı çıkarım işlemleri hedefleniyor.

Cerebras'ın Wafer-Scale Engine'i, tek bir devasa silikon levha üzerinde bir yapay zeka süper bilgisayarının belleğini ve işlem gücünü barındırıyor. Yüz binlerce işlem çekirdeği ve onlarca gigabayt SRAM, herhangi bir harici ağ darboğuna takılmadan verimli veri akışını sağlıyor.

Temel olarak Cerebras'ın Wafer-Scale Engine'i, orta ölçekli bir yapay zeka modelini veya büyük bir modelin önemli parçalarını kendi birleşik SRAM'i içinde tutabiliyor. Ayrıca, Cerebras'ın bu yaklaşımı hem eğitim hem de çıkarım iş yükleri için esneklik sunuyor.

AMD'nin vizyoner yol haritasına göre Helios, yüksek performanslı ve ölçeklenebilir bir işlem gücü sağlarken, Cerebras'ın teknolojisi ultra hızlı ve ultra düşük gecikmeli kod çözme ve jeton (token) üretimi gerçekleştirecek. Bu iki işlem gücü motorunun birlikte, watt başına saniyede 5 kata kadar daha fazla jeton üretmesi bekleniyor.

Tüm bu gelişmeler, OpenAI'den Jeffrey Wang'ın Cerebras'ın çip mimarisinden güç alan sistemlerini övgüyle bahsetmesiyle daha da önem kazanıyor. Wang, bu çiplerin "çıkarım görevlerinde inanılmaz olduğunu" belirterek, bunun temel nedeninin "olağanüstü derecede hızlı çıkarım yetenekleri" olduğunu vurguladı.

Yapay zeka modellerinin tipik olarak farklı görevler arasında geçiş yaparken bağlam değiştirmesi gerekir. Bu durum, modelin çeşitli görevleri yerine getirmesi gereken çoklu ajanlı (multi-agentic) ortamlarda veya belirli bir görevi yerine getirmede uzmanlaşmış çeşitli alt sinir ağlarının bulunduğu Uzmanlar Karışımı (Mixture of Experts - MoE) modellerinde ortaya çıkabilir.

OpenAI'nin Cerebras sistemlerinden etkilenmiş olması, AMD Helios sunucu tabanlı sistemlerinin Wafer-Scale Engine'lerle entegre edildiğinde piyasaya sürüldüğünde büyük ilgi göreceği anlamına geliyor. Özellikle çıkarım maliyetlerinin veri merkezi karlılığında giderek daha büyük bir rol oynadığı günümüzde bu durum büyük önem taşıyor.

Önceki Haber
Yapay Zeka Yarışında Çinli Startup'tan Cesur Hamle: NVIDIA GPU'larına Göz Dikti!
Sıradaki Haber
24 Saati Aşan Rekor Uçuş Tamamlandı: Avustralya'dan Fransa'ya Kesintisiz Yolculuk

Benzer Haberler: