Ara

Açık Kaynak Yapay Zeka Modellerinde Fırtına: Çin, ABD’yi Yakalıyor!

Mozilla'nın 15 Eylül'de yayımladığı ve 1 Eylül verilerini baz alan 'Açık Kaynak Yapay Zeka Durumu' raporu, en iyi Çin yapay zeka modellerinin ABD'nin öncü tekliflerine hızla yaklaştığını ortaya koyuyor. Yapay Zeka Analizi Endeksi'nde en iyi açık model, kapalı modellere göre %60 daha uygun fiyata sadece üç puan geride kalırken, Claude Fable 5'in iki puan arkasında yer alıyor. Mozilla'nın METR görev-ufuk verilerine göre, açık ve kapalı modeller arasındaki fark yaklaşık 4.4 aya indi. Bu durum,Epoch AI'nin dört aylık tahminleriyle de paralellik gösteriyor.

Firefox'un arkasındaki kar amacı gütmeyen kuruluş Mozilla, bu raporu düzenli olarak yayımlıyor. İlk rapor 14 Temmuz'da Mozilla blogunda yer almıştı. Rapor, yaklaşık 1.400 geliştiriciyle yapılan bir anketin yanı sıra OpenRouter trafik verileri ve üçüncü taraf kıyaslama endekslerinden elde edilen bilgilerle hazırlanmış. Mozilla, açık modelleri savunuyor ve bu raporun bir kısmının bu savunmanın bir parçası olduğunu belirtiyor. Bu bağlamda 'açık ağırlıklar', eğitim verileri veya kod yerine indirilebilen ağırlıklar anlamına geliyor. Raporda 16 dikkat çekici açık modelden bahsedilse de, Açık Kaynak Girişimi'nin tanımının gerektirdiği veri tarifini hiçbiri sunmuyor.

Dört aylık fark, modellerin insan çalışma süresiyle tamamladığı görevlerin uzunluğuna göre puanlama yapan araştırma kuruluşu METR'ye dayanıyor. Mozilla'nın hesaplamalarına göre, kapalı modeller insan uzmanların 8 ila 12 saat süren görevlerini yerine getirirken, açık modeller bu seviyeye yaklaşık dört ay sonra ulaşıyor. Mozilla'nın hesaplamalarına göre, açık modellerin yetenekleri her 3.9 ayda iki katına çıkarken, kapalı modellerin yetenekleri 5.5 ayda iki katına çıkıyor. Mozilla ayrıca, her modeli aynı yazılım katmanından geçiren vals.ai'nin Terminal-Bench 2.1 sonuçlarını da grafiklere dökmüş. Bu listede, Z.ai'nin GLM-5.2 modeli Claude Opus 4.7'ye bir puan farkla ve Opus 4.8'e dört puan geriden, test başına maliyetin beşte birinden daha azıyla takip ediyor. OpenRouter'da yüzlerce modele geliştirici trafiği yönlendiren bir pazar yeri olan Mozilla, ağustos ayı token hacmine göre ilk on modelin sekizinin açık ağırlıkta olduğunu ve bunların yedisinin Çin yapımı olduğunu belirtiyor. Ancak, Linux Foundation'ın bildirdiğine göre, kapalı sağlayıcılar Mayıs-Eylül 2025 arasında model katmanı gelirlerinin %96'sını elde etmiş. Krikorian, kapalı modeller için ödeme yapma kararının organizasyondan ziyade iş yüküne özgü olduğunu belirtmiş.

Burada dikkat edilmesi gereken bir nokta, dört aylık farkın ve %30 token fiyatı rakamının, barındırılan uç noktalarda API'den API'ye ve liste fiyatından ölçülmesidir. Raporun kendi donanım tablosu, tek bir sunucuya sığan en iyi açık modelin 52.6, tek bir GPU'da ise 40 puan olduğunu gösteriyor. En üst seviyeden bu düşüş sırasıyla 10 ve 23 puan daha az. Kimi K3'ün yerel MXFP4 kontrol noktası yaklaşık 1.56TB'ı 96 paya yayılırken, Mozilla'nın sunucu yapılandırması 64 veya daha fazla hızlandırıcı gerektiriyor. Rapor bunu açık olarak tanımlasa da, çoğu kullanıcının çalıştırmasının zor olduğunu belirtiyor ve vLLM, üretim trafiği için birden fazla düğümle en az sekiz GB300 GPU gerektirdiğini ifade ediyor. Tom's Hardware, Temmuz ayında bellek ihtiyacının yaklaşık 1.5TB civarında olduğunu belirtmişti. Tek istisna, Apache 2.0 lisansı altında yer alan ve NVFP4 sürümü tek bir B300'e 180GB taban ile sığan Thinking Machines'in Inkling-Small modeli olarak öne çıkıyor.

Raporun verileri 1 Eylül'de sona eriyor. O tarihten bu yana, Yapay Zeka Analizi farklı bir değerlendirme setiyle endeksini v4.3'e taşıdı. Canlı tabloda Claude Fable 5.1, en yüksek çaba ayarında 53 puanla, Kimi K3 ise 44 puanla Mozilla'nın v4.1.1 sayılarıyla karşılaştırılamayacak durumda. vals.ai'nin 11 Eylül'de güncellenen Terminal-Bench 2.1 tablosunda ise GPT-6 Astra %87.27 ile ilk sırada, Fable 5.1 ise %85.02 ile ikinci sırada yer alıyor. Mozilla'nın kendi grafik başlığı, 'farkın her sürüm döngüsünde sıfırlandığını' belirtiyor. K3 hakkında ayrıca, 8 Eylül tarihli NSA/CISA/FBI ortak duyurusunda (AA26-251A) detaylandırılan bir iddia bulunuyor. Mozilla'nın raporunda 'iddia edildiği ancak kanıtlanmadığı' belirtilen bu iddiaya göre Moonshot, K3'ü damıtma yoluyla, yani bir modelin çıktısını başka bir modelin eğitiminde kullanarak eğitti. 17 Temmuz'da Yapay Zeka Analizi, K3'ü 57 puanla Fable 5'in 60 puanına karşı değerlendirmişti; 1 Eylül'de ise Mozilla, K3'ü iki puan geride göstermişti.

Önceki Haber
26 Yıllık Sır Perdesi Kalktı: PlayStation 2'nin Güvenlik Çipi Çözüldü!
Sıradaki Haber
Blizzard'dan Şaşırtan Karar: World of Warcraft: Forever Geliyor, WoW 2 İptal!

Benzer Haberler: