Ara

NVIDIA Groq 3 LPX, Yapay Zeka Çıkarım Hızında Rekor Kırıyor: Vera Rubin Platformu Yeni Bir Seviyeye Ulaşıyor

Yapay zeka alanındaki gelişmeler hız kesmeden devam ediyor. NVIDIA, Groq 3 LPX yapay zeka çıkarım hızlandırıcı çiplerinin tam üretim bandına girdiğini duyurdu. Bu gelişme, özellikle ajan tabanlı yapay zeka (Agentic AI) uygulamaları için token üretim hızında önemli bir sıçrama vaat ediyor.

NVIDIA Vera Rubin NVL72'nin Token Üretim Kabiliyetlerini Güçlendiriyor: Groq 3 LPX ile Saniyede 3.400 Token Üretimi

NVIDIA, yapay zeka alanındaki yol haritasını kararlılıkla sürdürerek, Groq 3 LPX yapay zeka çıkarım hızlandırıcı çiplerinin tam üretim aşamasına geçtiğini duyurdu. Bu duyuru, Vera CPU'ları ve Vera Rubin sunucularının seri üretim duyurularının ardından geldi ve NVIDIA'nın yapay zeka stratejisindeki sağlam adımları vurguluyor.

Groq 3 LPX çipleri, NVIDIA Vera Rubin platformunun bir uzantısı olarak hizmet veriyor. Bu yeni nesil hızlandırıcılar, özellikle yanıt hassasiyeti gerektiren ajan tabanlı iş yükleri için ultra hızlı token üretimi sağlayarak yapay zeka çıkarım kabiliyetlerini artırıyor. Bu sistemler, yüzlerce hatta binlerce çıkarım adımında büyük miktarda token üretebildiği için, hızlı token üretimi yapay zeka fabrikaları için kritik bir öneme sahip.

NVIDIA Vera Rubin NVL72, ajan tabanlı yapay zeka uygulamaları için en gelişmiş çözümlerden biri olsa da, Groq 3 LPX çözümü ile yetenekleri daha da ileriye taşınıyor.

NVIDIA'nın yaptığı bir gösterimde, Groq 3 LPX ile donatılmış Vera Rubin NVL72 platformu, Gemma 4 31B açık kaynak modelini kullanarak yapay analizde saniyede rekor seviyede 3.400 token üretti. 100.000 tokenlik bir bağlam penceresi ile bu, söz konusu model üzerinde kaydedilen en hızlı performans oldu.

Vera Rubin GPU'ları, büyük ölçekli bağlam işlemlerini yönetirken, LPX çipleri ise gecikmeye duyarlı kod çözme iş yüklerini hızlandırıyor. Bu sayede daha hızlı ve öngörülebilir token üretimi sağlanıyor. Bu da yapay zeka fabrikalarının daha hızlı akıl yürütme, daha akıcı ajan etkileşimleri ve daha yüksek altyapı verimliliği sunmasına yardımcı oluyor.

Groq 3 LPX ile NVIDIA, kodlama gibi ajan tabanlı yapay zeka görevlerinin saatler yerine dakikalar içinde tamamlanabilmesini sağlıyor. Bu da en yakın rakip platformlara kıyasla yanıt sürelerinde 4 katlık bir artış anlamına geliyor.

NVIDIA Groq 3 LPX çözümü, yapay zeka bulut sağlayıcıları tarafından da artan ihtiyaçlara yönelik bir çözüm olarak görülüyor. Bu sayede işletmeler ve geliştiriciler, ölçeklenebilir eğitim, akıl yürütme ve çıkarım için gelişmiş altyapıya erişebiliyor. Örneğin, Nebius bulut hizmetleri, Groq 3 LPX'i Token Fabrikası'nda kullanmayı planlıyor.

Groq 3 LPX ve Vera Rubin'in birlikte sunduğu çözüm, ajan tabanlı yapay zeka dönemi için tasarlandı. Maksimum yanıt verme, verimlilik ve performans için özel olarak tasarlanmış bir çıkarım mimarisi sunarak, yeni nesil yapay zeka fabrikalarının temelini oluşturuyor.

Teknoscope olarak, yapay zeka teknolojilerindeki bu önemli gelişmeleri yakından takip etmeye devam edeceğiz.

Önceki Haber
Teknoscope Özel: Intel'in 18 Çekirdekli Gücü Dev İndirimle Karşımızda! Core Ultra 5 250K Plus Sadece 139$
Sıradaki Haber
Intel'den Dev Atılım: Diamond Rapids Xeon 7 Serisi 256 Çekirdek ile Sahneye Çıkıyor!

Benzer Haberler: