Alibaba, NVIDIA'nın başarıyla uyguladığı dikey entegrasyon stratejisini kendi bünyesinde hayata geçiriyor gibi görünüyor. Şirket, güçlü yapay zeka modeli Qwen-3.8 27B'nin, kendi tasarladığı XuanTie C950 adlı RISC-V çipi üzerinde doğrudan çalışabilmesini sağlayarak önemli bir adım attı. Bu gelişme, sadece 32GB VRAM ile çalışabilen bir yapay zeka modelinin kendi donanımı üzerinde verimli bir şekilde çalıştırılması anlamına geliyor.
Alibaba, Qwen Serisi Yapay Zeka Modellerini Kendi Çiplerinde Çalıştırarak Rekabetçi Pazarda Güçlü Bir Konum Ediniyor
Alibaba, XuanTie C950 çipini Mart 2026'da duyurmuştu. Çip, özellikle uç bilişim (edge AI) uygulamaları için tasarlanmış bir RISC-V tabanlı çözüm olarak tanıtılmıştı. XuanTie C950, tipik özel entegre devrelerden (ASIC) farklı olarak yapay zeka iş yükleri için GPU'lara dayanmıyor. Bunun yerine, sunucu sınıfı, 64-bit bir RISC-V işlemci olarak görev yapıyor. Tek bir silikon üzerinde yer alan 64 adet işlem çekirdeği, 3.20GHz'e kadar ölçeklenebilen saat frekanslarına sahip ve yüksek hızlı AMBA CHI ara bağlantılarıyla birbirine entegre edilmiş kümeler halinde çalışıyor. Ayrıca, yoğun yapay zeka iş yüklerini yönetmek amacıyla matris ve vektör hızlandırma motorları doğrudan çip üzerine entegre edilmiş durumda, bu da GPU ihtiyacını ortadan kaldırıyor.
Alibaba'nın XuanTie C950 çipi, standart L1 ön bellekler, esnek ve yüksek derecede yapılandırılabilir L2 ön bellek ve çekirdekler arası iletişim darboğazlarını önlemek için isteğe bağlı paylaşımlı bir L3 ön bellek içeriyor. Çip ayrıca, yürütme motoru tarafından istenmeden önce bellek dizilerini ön belleğe yükleyen donanım düzeyinde akıllı veri ön getirme algoritmaları kullanıyor. Diğer önemli detaylar şunlar:
- Çip, açık kaynaklı RISC-V ISA üzerine kurulu. Bu, Alibaba'nın x86 mimarisi veya ARM tasarımlarıyla ilişkili lisans ücretlerinden kaçınmasını sağlıyor ve aynı zamanda daha fazla özelleştirme imkanı sunuyor.
- Çip, 8 komut çözme genişliğine sahip. Bu, çekirdeğin aynı anda büyük miktarda komutu okuyup işlemesine olanak tanıyor.
- Çip, 16 aşamalı bir boru hattına sahip. Bu yapı, yüksek saat hızlarını koruma ile her komutu 16 parçaya bölerek karmaşık sunucu ve yapay zeka iş yüklerini verimli bir şekilde yürütme arasında bir denge kuruyor.
- GPU'ların aksine, XuanTie C950 soket başına tek bir çıkarım iş parçacığı çalıştırıyor. Bu da onu yüksek eşzamanlılığa sahip genel API'ler yerine uç bilişim (edge deployment) ve özel çıkarımlar (private inference) için daha uygun hale getiriyor.
- Özel boru hattı ve entegre hızlandırma motorlarının birleşimi, XuanTie C950'yi milyar parametreli Büyük Dil Modellerini (LLM) tamamen yerel olarak çalıştırabilen ilk RISC-V işlemci yapıyor. Emülasyon veya çeviri katmanlarına ihtiyaç duymadan, donanım birimleri ve komut seti uzantıları küçük ve orta ölçekli yapay zeka modelleri için gerekli temel işlemleri doğrudan yürütecek şekilde tasarlanmış.
- Önemle belirtmek gerekirse, XuanTie C950'nin TSMC tarafından 5nm düğümünde üretildiği düşünülüyor, ancak Alibaba bu konuda doğrudan bir doğrulama yapmadı.
Bu durum, bugünün konusunun temel noktasına geliyor. Alibaba, en yeni Qwen-3.8 27B modeli için gün sıfır desteğini XuanTie C950 çipine getirerek, saniyede 30 token çözme hızı ve sadece 1.9 saniye 'İlk Token'a Kadar Süre' (TTFT) sunuyor.
Bilgi vermekte fayda var, Qwen-3.8 27B, 27 milyar parametreye sahip, açık ağırlıklı bir yapay zeka modeli. Kodlama yetenekleri oldukça gelişmiş ve tek bir dizüstü bilgisayarda çalışabiliyor.
Bu model için gün sıfır desteğini XuanTie C950'ye getirerek, Alibaba hem müşterileri kendi ekosistemi içinde tutmaya çalışıyor hem de hesaplama ayak izi etrafındaki seçenekleri önemli ölçüde genişletiyor. Sonuçta, Alibaba, çıkarımla ilgili iş yüklerini verimli bir şekilde yönetmek için C950'yi veri merkezlerindeki diğer yapay zeka hızlandırıcılarla kolayca eşleştirebilir.