NVIDIA'nın merakla beklenen yapay zeka platformu Vera Rubin nihayet tanıtıldı. Mevcut sistemlere kıyasla inanılmaz bir performans artışı sunan Vera Rubin, yapay zeka çağında yeni bir dönemin kapılarını aralıyor.
NVIDIA Vera Rubin Artık Devrede: Blackwell'e Karşı Aynı Güç Tüketimiyle 800.000 Token/s Hıza Ulaştı!
Bugün itibarıyla dünyanın gördüğü en güçlü yapay zeka platformu olan Vera Rubin, teknoloji dünyasına merhaba diyor. NVIDIA'nın 'Extreme Co-Design' girişimi kapsamında geliştirilen bu platform, yapay zeka donanım ve yazılımını bir araya getirerek watt başına eşsiz bir performans ve en düşük token maliyetini hedefliyor. Vera Rubin, yapay zeka alanında yeni bir çığır açıyor.
NVIDIA Vera Rubin platformu, kapsamlı bir yapay zeka ekosistemini oluşturan beş katmanlı yapısal modelin hayata geçirilmiş hali olan çeşitli donanım ve yazılım çözümlerini bünyesinde barındırıyor. Bu yapı, dünyanın en gelişmiş çiplerinden bazılarını barındıran altı adet tray'den oluşuyor:
- NVIDIA Vera Rubin NVL72 Hesaplama Tray'i (Rubin + Vera + Grace Bluefield + ConnectX-9)
- NVIDIA Vera Rubin NVL72 NVLink Anahtar Tray'i (NVLink6 Anahtar)
- NVIDIA Vera CPU Tray'i (Vera)
- NVIDIA Spectrum-6 SPX Anahtar Tray'i (Spectrum-6 Anahtar)
- NVIDIA Groq 3 LPX Tray'i (Groq 3)
- NVIDIA Vera Bluefield-4 STX Depolama Tray'i (Vera Bluefield)
NVIDIA'nın rack ölçekli çözüm süreci de sürekli iyileştirmelerden geçti. Tıpkı SpaceX'in Raptor motorlarını geliştirerek daha gelişmiş ve verimli Raptor 3'ü ortaya çıkarması gibi, NVIDIA da Vera Rubin tray'lerini daha akıcı, kablosuz, fansız ve gövdesiz bir tasarıma sahip, sıvı soğutmalı ve modüler bir yaklaşımla entegre edilerek rack'lere sorunsuz bir şekilde uyum sağlayan bir yapıya kavuşturdu. Bu durum, mühendislik çalışmalarının sadece çipler ve kodlarla sınırlı kalmadığını gösteriyor.
NVIDIA'nın ilk Vera Rubin NVL72 sistemleri faaliyete geçti ve ilk sonuçlar gelmeye başladı. Geçtiğimiz ay, önde gelen bulut sağlayıcılarının NVIDIA'nın Vera Rubin platformlarını kurup doğruladığını bildirmiştik; bugün ise bu sistemlerin performansını görme şansımız oluyor.
Yapılan ilk DeepSeek R1 testlerinde, firmanın Grace Blackwell sistemlerine kıyasla watt başına 10 kat daha yüksek token işleme hızı sağladığı görüldü. NVIDIA GB200 NVL72 Grace Blackwell sistemi 150 MW güç tüketimiyle yalnızca 80.000 Token/s hızına ulaşabilirken, NVIDIA VR200 NVL72 Vera Rubin platformu aynı güç tüketimiyle 800.000 Token/s gibi etkileyici bir hıza ulaştı. Bu sonuçlar, özellikle MoE (Mixture-of-Experts) iş yüklerinde devasa bir artışa işaret ediyor.
Bu sadece bir başlangıç. Daha fazla sistem çevrimiçi oldukça ve potansiyellerini sergiledikçe NVIDIA'nın Vera'sı piyasayı sarsmaya hazırlanıyor. Şirketlerin Gigascale düzeyinde yapay zeka yeteneklerine ulaşmasını sağlayacak güçlü ağ çözümleriyle desteklenen NVIDIA, bir kez daha neden yapay zekanın lideri olduğunu kanıtlıyor.