Yapay zeka alanında rekabetin dozu giderek artıyor. OpenAI, yeni duyurduğu GPT-6 Sol ve GPT-6 Luna modelleriyle rakiplerine gözdağı veriyor. Bu modellerin fiyatları, önceki sürümlerine kıyasla yüzde 50 daha uygun hale getirilirken, özellikle GPT-6 Luna'nın API fiyatları, sektörün verimlilik şampiyonu DeepSeek V4.1 Flash'ın bile gerisinde kaldı.
Anthropic ve OpenAI'nin peş peşe duyurduğu yeni modeller, yapay zeka geliştirme hızının yavaşlamayacağının bir işareti olarak görülüyor. Bu gelişmeler, yapay zeka alanındaki hızla ilerleyen yeniliklere dikkat çekiyor.
GPT-6 Sol ve GPT-6 Luna: Fiyatlarda Devrim
OpenAI'nin yeni gözdesi GPT-6 Sol, 1 milyon girdi birimi için sadece 2 dolar, GPT-6 Luna ise aynı birim için sadece 0.10 dolar gibi şaşırtıcı fiyatlarla sunuluyor. Bu durum, yapay zeka modellerinin erişilebilirliğini önemli ölçüde artırıyor.
GPT-6 Sol, girdi ve çıktı fiyatları açısından Anthropic'in Claude 5.5 Opus modelinden yüzde 50 daha ucuz. GPT-6 Luna ise DeepSeek V4.1 Flash modelinin yoğun olmayan saatlerdeki API fiyatlarından bile daha uygun bir seviyede. DeepSeek V4.1 Flash, 1 milyon girdi birimi için 0.15 dolar ve 1 milyon çıktı birimi için 0.60 dolar fiyat etiketine sahipken, GPT-6 Luna bu maliyetleri daha da aşağı çekiyor. Ancak, performans açısından DeepSeek V4.1 Flash, DeepSWE v1.1 testinde 74.2 puan alırken, GPT-6 Luna yaklaşık 67 puanda kalıyor.
OpenAI, GPT-6 Sol'un eğitiminde GPT-6 Astra'ya benzer yöntemler kullandığını ve bunun sonucunda akıl yürütme, gerçeklere dayalı güvenilirlik, kodlama, bilgisayar kullanımı ve uyumluluk alanlarında önemli geliştirmeler sağlandığını belirtiyor.
Yapılan analizlere göre, GPT-6 Sol'un tipik bir görev için maliyeti yaklaşık 1.06 dolar iken, bu rakam GPT-5.6 Sol için 1.99 dolardı. GPT-6 Luna'nın maliyeti ise 0.07 dolara düşerek, GPT-5.6 Luna'nın 0.18 dolarlık fiyatına göre önemli bir gerileme gösterdi. Yapay Zeka Analizi'ne göre, şu anda Claude Opus 5.5 58 puanla liderliğini sürdürürken, GPT-6 Sol 48 puanla onu takip ediyor. Bu sonuçlar, beklentilerin bir miktar altında kalmış gibi görünüyor.
GPT-6 Sol'un kodlama yetenekleri gelişmiş olsa da, GPT-6 Luna'nın GPT-5.6 Luna'ya kıyasla hafif bir gerileme gösterdiği belirtiliyor. Ayrıca, AA-Omniscience Index tarafından ölçülen halüsinasyon oranlarında da düşüşler gözlemleniyor. GPT-6 Sol'un (maksimum) halüsinasyon oranı yüzde 92'den yüzde 60'a inerken, GPT-6 Luna'nınki yüzde 93'ten yüzde 77'ye düştü. Sol'un bu düşüşü, daha fazla soruyu yanıtsız bırakarak yanlış cevapları azaltmasıyla sağlanıyor, ancak bu durum doğruluğu da 5 puan düşürerek yüzde 54'e çekiyor. Luna'nın doğruluğu ise yaklaşık yüzde 44'te kalırken, o da daha az soruya cevap veriyor.
GPT-6 Sol ve GPT-Luna'nın her ikisi de GDPval-AA v2.1 testlerinde daha kısa çıktılar vermeleri ve gerekli unsurları daha sık atlamaları nedeniyle bir gerileme kaydetti. GPT-6 Sol, DeepSWE, bilgisayar kullanımı ve araştırma hata ayıklama alanlarında GPT-5.6 Sol'dan daha kötü bir performans sergilerken, siber yeteneklerinde ise onu yakaladı.
Anthropic'in Claude Opus 5.5 modeli, aynı anda yaklaşık 100 ajanı paralel olarak çalıştırma yeteneğiyle tanıtıldı. OpenAI'nin GPT-6 Astra'sı zaten benzer yeteneklere sahipken, yapay zeka laboratuvarı şimdi GPT-6 Sol ve GPT-6 Luna'yı cazip fiyat noktalarına taşıyarak değer teklifini daha da artırmaya çalışıyor. Claude Opus 5.5'in OSWorld 2.0 Offline testinde, görev başına maliyetin beşte biri karşılığında GPT-6 Astra'yı geçmesi göz önüne alındığında, bu fiyatlandırmanın önemi daha da artıyor.