NVIDIA, yapay zeka alanındaki öncü rolünü pekiştiren önemli güncellemelerle karşımızda. DGX ve RTX sistemleri için sunulan bu yenilikler, Nemotron 3.5 ve LTX 2.5 gibi yeni açık modelleri destekleyerek performansı önemli ölçüde artırıyor ve bellek kullanımını optimize ediyor.
NVIDIA, En Yeni Açık Yapay Zeka Modeli Desteğiyle "Yapay Zeka PC" Segmentine Öncülük Etmeye Devam Ediyor
Nemotron 3.5 Lightning'in piyasaya sürülmesinin yanı sıra NVIDIA, kullanıcı odaklı "Yapay Zeka PC" tarafında da büyük güncellemeler sunuyor. Bu güncellemeler, NVIDIA'nın DGX ve RTX platformlarını hedefleyerek açık yapay zeka modellerini hızlandırmak için daha yüksek performans ve optimizasyonlar getiriyor, ayrıca bu platformlarda PC deneyimini zenginleştirecek yeni yetenekler ekliyor.
Bugünkü sürümün öne çıkan başlıkları şunlardır:
- NVIDIA Sync Cluster Assistant ile DGX Spark Ölçeklendirme — İki veya daha fazla sistemi yüksek hızlı bir küme olarak bağlayarak ağ, iş yükü yönlendirme ve sağlık izleme süreçlerini kolaylaştırıyor.
- DGX Spark'tan Daha Fazla Verim Alın — Google Chrome, yerel ARM64 Linux sürümüyle geliyor. Yeni NVIDIA Sync Resource Monitor ise tek bir sistem veya tüm küme genelinde gerçek zamanlı ve geçmiş CPU ile GPU görünümleri sunuyor.
- Meta'nın Muse Glimmer Modelini Yerel Olarak Çalıştırın — 30 milyar parametreli açık ağırlık model, sürekli aktif yerel ajanlar için optimize edilmiş olup, bir RTX 5090 üzerinde saniyede 200'den fazla token üretebiliyor.
- LTX-2.5 ile Yüksek Kaliteli Video Üretimi — Açık video modeli, çoklu çekim (multishot) üretimi ve üretken düzenleme özelliklerini ekleyerek NVIDIA RTX GPU'lar, DGX Spark ve DGX Station üzerinde iki kat performans artışı ve %40 bellek tasarrufu sağlıyor.
- NVIDIA Tarafından Hızlandırılan Daha Fazla Açık Model Keşfedin — Cosmos 3 Edge, MiniMax-H3, Poolside'ın Laguna S 2.1'i, DeepSeek-V4-Flash, Thinking Machines Lab'ın Inkling-Small'ı, Unsloth Desktop ve Wan-Animate-2 gibi modelleri içeriyor.
Yeni açık model desteğiyle birlikte, NVIDIA'nın DGX ve RTX platformları artık Cosmos 3 Edge (4 milyar parametre), MiniMax-H3 (33 milyar parametre), Laguna S 2.1 (118 milyar parametre), DeepSeek V4-Flash (284 milyar parametre), Wan-Animate-2 (14 milyar parametre) ve Inkling-Small (276 milyar parametre) gibi yapay zeka modellerini tam olarak destekliyor.
Şirket ayrıca, yerel model çıkarımı, görüntü/video yayılımı, ince ayar, ajan entegrasyonları, web araştırması ve kod yürütme gibi özellikleri tam açık kaynaklı bir masaüstü uygulamasında sunan Unsloth Desktop için de destek getiriyor.
NVIDIA'nın RTX 5090 ve RTX PRO 5000 Blackwell gibi RTX platformları, Wan-Animate-2 modelinde Apple M3 Ultra'ya kıyasla sırasıyla 26 kat ve 16 kat daha yüksek performans sunarak kullanıcılara, bir statik karakter görüntüsüne hareket ve yüz ifadelerini aktaran açık ağırlık bir model olanağı sağlıyor.
Üretken Yapay Zeka (GenAI) konusunda ise LTX-2.5, yeni bir difüzyon video kod çözücüye sahip, bu da varyasyonel oto-kodlayıcı video kod çözücüye ek olarak daha yüksek kaliteli sonuçlar için ikinci bir yol sunarak video kalitesini iyileştiriyor.
LTX 2.5'te, RTX PRO 6000 96 GB GPU, videolar oluşturulurken %20 daha hızlı performans ve %40 bellek tasarrufu sağlıyor. Kullanıcılar ayrıca geliştirilmiş metin, görüntü ve videodan videoya üretim için NVIDIA'nın NVFP4, FastVideo ve ComfyUI araçlarından da faydalanabiliyor.
Meta'nın, özellikle kodlama ve Ajan Yapay Zeka (Agentic AI) için tasarlanmış 120K+ bağlamlı en yeni 30 milyar parametreli açık ağırlık modeli Muse Glimmer'ı da piyasaya sürüyor. Model, NVIDIA'nın RTX ve DGX sistemleri için optimize edilmiş olup, NVIDIA'nın Jetson platformlarını da destekleyerek tek bir RTX 5090 GPU üzerinde saniyede 200'den fazla token (TPS) hızına ulaşıyor. Muse Glimmer'ın bazı özellikleri şunlardır:
- Özel Ajanlar: Modeli belirli görevler, araçlar, veriler ve uzmanlık alanları için uyarlayın.
- Gizli Veri İşleme: Yerel dosyaları, belgeleri, e-postaları ve mesajları okuyun, özetleyin ve bunlara göre hareket edin.
- Kimlik Bilgisi Yönetimi: Çıkarım işlemini cihazda tutarken API anahtarlarını, kimlik doğrulama belirteçlerini ve diğer hassas bilgileri kullanın.
- Çok Adımlı Görevler: Birçok sıralı araç çağrısını tamamlayın ve hatalardan veya beklenmeyen sonuçlardan kurtulun.
- Uzun Süreli İş Akışları: Daha büyük projeleri adımlara bölün, ilerlemeyi izleyin ve kesintiye uğrayan oturumları bağlamı koruyarak devam ettirin.
Özellikle DGX Spark için NVIDIA'nın birkaç büyük güncellemesi bulunuyor. İlk olarak, birden fazla DGX Spark PC'yi daha büyük modeller için bellek, çıkarım ve işlem kapasitesini artırarak kümelemeyi çok daha kolay hale getiren yeni "NVIDIA Sync Cluster Assistant"ın piyasaya sürülmesi. Bu özellik hem Windows hem de macOS'ta mevcut.
DGX Spark ayrıca yerel bir ARM64 Linux sürümü olarak Google Chrome'u da bünyesine katıyor ve bu sürüm DGX OS üzerindeki DGX Dashboard'dan doğrudan yüklenebiliyor. Ayrıca, tekil veya kümelenmiş DGX Spark sistemlerinde CPU ve GPU kullanımının gerçek zamanlı ve geçmiş görünümlerini sağlayan yeni bir NVIDIA Sync Resource Monitor da mevcut.
NVIDIA, DGX ve RTX platformlarında daha hızlı performans, daha akıllı optimizasyonlar ve en yeni açık yapay zeka modelleri için geniş destek sunarak yapay zeka PC alanında liderliğini sürdürüyor.
Daha fazla ölçek için DGX Spark sistemlerini kümelemekten, Meta'nın Muse Glimmer'ı (RTX 5090 üzerinde 200'den fazla token/sn) gibi yüksek hızlı yerel modelleri çalıştırmaya ve LTX-2.5 ile geliştirilmiş video üretimine kadar bu güncellemeler, kullanıcılara daha güçlü, verimli ve çok yönlü cihaz içi yapay zeka yetenekleri sunarak NVIDIA'nın yapay zeka PC devrimindeki rolünü pekiştiriyor.