Ara

Moonshot’tan Yeni Hamle: Kimi K3.1 Geliyor, Çin Yapay Zekada Zirveye Yerleşti!

Yapay zeka dünyasında geçtiğimiz Temmuz ayında piyasaya sürdüğü Kimi K3 modeliyle büyük beğeni toplayan Moonshot, şimdi de yeni nesil modeli Kimi K3.1 ile gündemde. Geliştirici firma, Kimi K3.1'in Ekim ayından önce teknoloji meraklılarıyla buluşacağını işaret etti. Bu gelişmeler yaşanırken, yapay zeka alanındaki küresel hakimiyet mücadelesine dair önemli bir rapor da dikkat çekiyor.

Moonshot'ın İç Kodlarında Kimi K3.1 İmzası

Moonshot'ın iç kodlarında ve API yanıtlarında yapılan incelemeler, Kimi K3.1 modelinin yakında piyasaya sürüleceğine dair net sinyaller veriyor. Bu incelemelerde öne çıkan bazı detaylar şunlar:

  • "k3d1-agent" gibi model kimlikleri, doğrudan Kimi K3.1'e işaret ediyor.
  • Modelin farklı işlem seviyeleri için düşük, yüksek ve maksimum gibi seçenekler sunacağı görülüyor.
  • Bağlam uzunluğu ayarlarında "Ekstra Uzun" seçeneği ve 1 milyon token'a kadar destek sunulması planlanıyor.
  • Sürü ajanları, arama/toplu işleme gibi ajan modları, senaryolar ve diğer yapılandırma bayrakları da mevcut.
  • Modelin Ekim ayından önce piyasaya sürülmesi bekleniyor.

Moonshot'ın Kimi K3 modeli, daha önce geliştirdiği ve dikkat çeken 'Kimi Delta Attention' (KDA) adlı yeni bir mimariyle öne çıkmıştı. Yapay zeka modelleri temelde, kelimeler arasındaki bağlantıları kuran 'Dikkat Katmanı' ve modelin genel bilgisini taşıyan 'İleri Beslemeli Ağ' (FFN) olmak üzere iki ana bileşenden oluşur. KDA mimarisi, modelin ilk üç katmanında önemli bilgileri özetleyerek, bağlam uzasa bile özetin boyutunu sabit tutuyor. Bu sayede bellek ve HBM gereksinimleri önemli ölçüde azaltılıyor.

Ancak, bu yaklaşım bazı detayların gözden kaçırılmasına neden olabiliyor. Bu eksikliği gidermek için dördüncü katman, tüm bağlamın bir anlık görüntüsünü alıp sıkıştırıyor ve ihtiyaç duyulduğunda anlık olarak bu veriyi tekrar kullanıma açıyor. Bu yöntem, KV önbelleği ve bellek gereksinimlerini dramatik bir şekilde düşürüyor.

Moonshot'ın Kimi K3 modelini piyasaya sürmesinin ardından DeepSeek'in V4.1 Flash modelini tanıtması da rekabeti artırdı. DeepSeek'in yeni modeli, çeşitli mimari unsurlar kullanarak token başına yalnızca 890 bayt KV önbelleği ile dikkat çekiyor. Kimi K3.1'in, DeepSeek V4.1 Flash modelinin verimliliğiyle rekabet edebilmek için ne gibi yenilikler sunacağı merakla bekleniyor.

Çin Yapay Zeka Yeteneklerinde Yüzde 57 Payla Zirvede

Diğer yandan, yapay zeka alanındaki küresel dengeleri değiştirebilecek bir rapor, Çin'in yapay zeka yetenekleri konusundaki yükselişini gözler önüne seriyor. Carnegie'nin raporuna göre, Çin en iyi yapay zeka yeteneklerinin yüzde 57'sini barındırıyor. Bu oran, 2022'deki yüzde 46'lık paydan önemli bir artış anlamına geliyor. Buna karşılık, ABD'den çıkan en iyi yapay zeka yeteneklerinin oranı ise yalnızca yüzde 13 seviyesinde.

Son yıllarda ABD, yapay zeka araştırmacısı sayısını artırmış olsa da, rapor, yapay zeka yetenek akışlarının daha az akıcı hale geldiğini ve yeteneklerin büyük ölçüde kendi ülkelerinde kaldığını belirtiyor. Bu durum, ABD'nin küresel teknolojik liderliği açısından önemli bir zorluk teşkil ediyor.

Önceki Haber
Final Fantasy VII Revelation: Her Şeyi Görmek İçin Tek Sefer Yetmeyecek!

Benzer Haberler: