Ara

Cerebras CS-4: Saniyede Yapılandırılan, GPU Rafının 30 Saniyede Yapamadığını Tam 4 Trilyon Transistörlü WSE-3 Turbo ile 1 Saniyede Tamamlıyor!

Yapay zeka alanında çığır açan wafer-scale (dilim ölçekli) çipleriyle tanınan Cerebras, yeni WSE-3 Turbo çipini barındıran en yeni CS-4 çözümünü tanıttı. Bu yenilikçi teknoloji, yapay zeka hesaplama gücünde inanılmaz bir sıçrama vadediyor.

Cerebras CS-4, 250 PFLOPS'a Kadar Hesaplama Gücü Sunan Dilim Ölçekli Çiplerle Güçlendiriliyor

Cerebras, daha önce 3. Nesil Wafer Scale Engine (WSE-3) ile yapay zeka işlemci pazarında adından söz ettirmişti. WSE-3, tek bir çip üzerinde devasa bir işlem gücü sunuyordu. Şimdi ise Cerebras, bu yolculuğun yeni bölümünü WSE-3 Turbo (WSE-3T) ile açıyor. Bu yeni çip, önceki neslin "en büyük yapay zeka işlemcisi" unvanını korurken, 4 trilyon transistör ve 900.000 çekirdek ile yine sınırları zorluyor. 46.225 mm²'lik devasa yüzey alanına sahip olan çip, aynı zamanda 44 GB entegre SRAM belleği ile geliyor.

WSE-3T, yapay zeka alanında iki katına çıkan bir hesaplama gücü sunuyor. Tek bir wafer, 125 PFLOPS (seyreklik ile 250 PFLOPS) işlem gücüne sahip. Ayrıca bant genişliği de 43.2 PB/s'ye yükseltilmiş. Çip içi bağlantı, 53.5 PB/s bant genişliği sağlarken, çip dışı I/O 2.4 Tb/s bant genişliğine ulaşıyor. Wafer-scale engine'deki güncellemeler, gecikme süresini de 5 milisaniyeden 2 milisaniyeye düşürerek performansı daha da iyileştiriyor.

Ancak yapay zeka alanında günümüzde sadece çipler değil, bütünsel çözümler ön planda. Cerebras da bu doğrultuda en yeni CS-4 sistemini WSE-3T çipleriyle donatıyor. CS-4, modüler bir yapıya sahip olan yeni Nexus Platform Mimarisi üzerine inşa edilmiş. Bu mimari, Hesaplama, Güç ve I/O olmak üzere üç katmanı içeriyor. Her bir rack (sunucu dolabı), takılabilir bir "sırt çantası" tasarımına sahip. Bu sırt çantası, güç ünitesi ve soğutma sistemini barındırarak, dikey olarak güç dizisine entegre ediliyor.

Bu kendi kendine yetebilen dilim ölçekli "sırt çantaları", güç dönüşümü, doğrudan sıvı soğutma, yüksek hızlı I/O ve kontrol sistemlerini kompakt bir pakette birleştiriyor. Yeni tasarım, güç dönüşümünü wafer'lara yaklaştırarak güç kayıplarını neredeyse tamamen ortadan kaldırıyor. Bu sayede, WSE çiplerine daha fazla güç aktarımı sağlanıyor ve bu da daha yüksek frekanslar ve daha hızlı hesaplama anlamına geliyor.

Şirket, GPT-OSS 120B gibi modellerde de etkileyici hesaplama sonuçları elde ettiğini belirtiyor. Tek bir CS-4 rack'ı, bu modelde saniyede 4.400'den fazla token üretebiliyor. Hatta, GPU tabanlı bir yapay zeka çözümüyle yapılan karşılaştırmada, CS-4'ün 1 saniyede tamamladığı bir işlemi, GPU rafının 30 saniyede tamamladığı görülmüş. Bu, inanılmaz bir performans farkını ortaya koyuyor.

Genel olarak Cerebras, CS-4'ün watt başına verimlilikte CS-3'e göre 10 kat artış sağladığını iddia ediyor. Her bir CS-4 rack'ı, 750 PFLOPS yapay zeka hesaplama gücü, 7.2 Tb/s I/O bant genişliği ve 129.6 PB/s SRAM bant genişliği sunan üç adet WSE-3T (Turbo) çip barındırıyor. Yeni bağlantı çözümüyle, yapay zeka fabrikaları CS-4'ü, 50 trilyondan fazla parametreye sahip modelleri destekleyebilecek büyük ölçekli kümelere dönüştürebiliyor.

WSE-3T'li ilk CS-4 sevkiyatlarının bu çeyrekte başlaması bekleniyor. Cerebras, bu yeni çözümle NVIDIA gibi devlere rakip olmayı hedefliyor. Ayrıca Cerebras, yapay zeka hesaplama gücünü daha da artırmak için AMD ile de işbirliği yaparak, wafer-scale rack çözümlerini AMD'nin Helios AI rack'ı ile entegre etme çalışmalarına devam ediyor. Bu entegrasyonun, NVIDIA'nın Groq 3 LPX rack'larının KV önbelleğini kendi bünyesindeki büyük SRAM'e aktarması gibi bir etki yaratması bekleniyor.

Önceki Haber
Yasa Dışı Yapay Zeka İstasyonu Çöktü: Bir Kullanıcının Hükümet Sitesine Sızması Her Şeyi Mahvetti

Benzer Haberler: