Ara

Yapay Zeka Dünyasında Maliyet Devrimi: Yeni Modeller Hem Daha Ucuz Hem Daha Hızlı!

Yapay zeka teknolojilerinde çığır açan gelişmeler yaşanıyor. Son dönemde hem OpenAI hem de Anthropic şirketleri, yapay zeka modellerinin maliyetini düşürmeye yönelik yeni sürümlerini tanıttı. Bu yenilikler, özellikle kodlama ve karmaşık bilgi işleme gibi alanlarda devrim yaratmayı hedefliyor.

Anthropic, ana akım iş gücü modeli olan Opus'un en güncel versiyonu Opus 5.5'i duyurdu. OpenAI ise hız ve verimlilik odaklı orta segment modelleri GPT-6 Sol ve Luna'yı piyasaya sürdü.

Bu yeni sürümlerin temel amacı, çığır açıcı yeni yetenekler sunmaktan ziyade verimliliği artırmak. Zira hem OpenAI hem de Anthropic, kurumsal müşterileri hedef alırken, açık kaynaklı modellerle rekabet etme yarışında. Kuruluşlar, maliyetli ve ileri düzey modeller yerine daha uygun fiyatlı alternatifleri kullanma eğilimindeler.

Her iki şirket de bu yeni sürümlerle modellerin yeteneklerini bir adım öteye taşıdıklarını ve maliyetleri önemli ölçüde düşürdüklerini savunuyor.

Opus 5.5: Daha Uygun Fiyatlı, Daha Rekabetçi Amiral Gemisi

Opus 5.5, tanıtılan modeller arasında daha üst segmentte yer alsa da, Anthropic'in OpenAI ile olan rekabetinde biraz geriden gelme çabasında olduğu görülüyor. OpenAI'nin ay başında piyasaya sürdüğü GPT-6 Astra modeli, bazı benchmark testlerinde ve kullanıcı geri bildirimlerinde Opus 5'i geride bırakmıştı. (Fiyat ve yetenek açısından Astra, hem Opus hem de Fable ile rekabet ediyor.)

Anthropic ve iş ortaklarının gerçekleştirdiği benchmark testleri, Opus 5.5'in bazı durumlarda kodlama ve bilgi işleme görevlerinde GPT-6 Astra'dan mütevazı da olsa daha iyi performans gösterdiğini ortaya koyuyor.

Asıl önemli olan ise maliyet. Anthropic'in duyurusuna göre: “Girdi ve çıktı token'ları milyon başına sırasıyla 4 dolar ve 20 dolar, bu da Opus 5'e göre %20 daha ucuz. Önbellek okumaları (aracı ve kodlama işlerinin maliyetinin çoğunu oluşturan) milyon token başına 0.20 dolar, Opus 5'e göre %60 daha ucuz. Opus 5.5 ayrıca Opus 5'ten %30'dan fazla daha hızlı çıktı üretiyor.”

Anthropic, tipik iş yüklerinde varsayılan ayarlarda tasarrufun Opus 5'e kıyasla %40'a yaklaştığını iddia ediyor. Çünkü token maliyetlerinin düşmesinin yanı sıra, Opus 5.5 görevleri tamamlarken daha az token kullanıyor.

Opus 5.5'in siber güvenlik ve biyoloji gibi “yüksek riskli alanlarda” dikkate değer ölçüde yetenekli olduğu belirtiliyor. Bu nedenle, Fable 5.1 için geçerli olan aynı korumalar burada da uygulanacak; istekler, korumalı alanlara girildiği tespit edilirse otomatik ve şeffaf bir şekilde daha eski bir modele yönlendirilebilir.

GPT-6 Sol ve Luna: Mütevazı, Maliyet Odaklı Bir Yükseltme

OpenAI'nin GPT-6 Sol ve Luna modellerinin piyasaya sürülmesi, yinelemeli bir ilerleme olarak görülebilir. Kısa bir süre önce şirket, GPT-5.6 model ailesi için Sol, Terra, Luna isimlendirme geleneğini tanıtmıştı. Ve daha yakın zamanda (bu ay içinde) en gelişmiş ve en güçlü modeli olan GPT-6 Astra'yı tanıtmıştı.

Bu isimlerin ne anlama geldiği tam olarak anlaşılmayabilir, bu yüzden hızlı bir özet: Astra en agresif güçlü (ve pahalı) modeldir, ağır kodlama, araştırma vb. için tasarlanmıştır. Sol, yetenekli ancak daha verimli ve uygun fiyatlı bir alternatiftir, günlük görevler için kullanılır. Terra, dengeli, genel kullanıma yönelik modeldir. Luna ise hızlı, ucuz seçenektir.

Astra'yı Anthropic'in Fable'ı ile, Sol'u Opus ile, Terra'yı Sonnet ile ve Luna'yı Haiku ile karşılaştırmak makul ve kabaca bir eşleştirme olabilir, ancak özellikle üst düzey modeller için bu mükemmel bir eşleştirme olmaz.

OpenAI, GPT-6 Sol ve Luna'nın GPT-6 Astra ile aynı yöntemlerle eğitildiğini belirtiyor. Benchmark testlerine bağlı olarak, belirli görevlerde önceki modellerine göre yüzde birkaç puan daha yetenekliler, ancak kullanımları yarı fiyatına.

GPT-6 Sol'un API fiyatlandırması, 1 milyon girdi token'ı için 2 dolar ve 1 milyon çıktı token'ı için 10 dolar. Luna için ise bu rakamlar sırasıyla 0.10 dolar ve 0.50 dolar.

Görüş: Şeytan Detaylarda Saklıdır

Gelişmiş modeller etrafındaki tartışmalar kaotik. Sosyal medyada GPT-6 Astra gibi modellerle karmaşık 3D video oyunlarının tek seferde oynanabileceğini ilan edenler var, ancak aynı zamanda güvenlik ihlalleri ve diğer uyum sorunları, yavaşlama çağrıları ve düzenlemeler gibi haberler de mevcut.

Bunların bir kısmı ciddi dikkat hak ederken, bir kısmı gürültüdür ve bir kısmı da ticari konumlandırma için abartılmaktadır.

Dahası, Anthropic, OpenAI, Alibaba veya diğer büyük oyuncuların modellerinin son aylardaki ilerlemenin ve sonuçların tek motoru olmadığı giderek daha fazla kabul görüyor. Modellerin orkestrasyonu ve çerçeveleri en azından ilerlemenin kendisi kadar önemlidir.

Gelişmeler hala ilerliyor ve bugünün modelleri, birkaç ay önceki modellere göre daha yetenekli ve uyumlu. Ancak bazı geliştiriciler ve işletmeler, sınırlarla biraz daha az ilgileniyor ve bunun nasıl operasyonel hale getirileceğine ve maliyet etkinliğinin nasıl korunacağına odaklanıyor.

Bu nedenle, yapay zeka liderlerinin güvenlik nedenleriyle veya kısmen yavaşlama çağrısı yapmasına rağmen, pratik ve ekonomik bir gerçek de var: Şu anki modellerimiz birçok faydalı şeyi yapmak için yeterince iyi, ancak insan varlıklar tarafından karmaşık bağlamsallaştırma ve operasyonel hale getirme gerektiriyorlar - ister çalışma zamanı ve çerçevelerde ister organizasyonel uygulamalarda olsun - kullanıma alınmaları için. Sonuç olarak, bu şirketlerin bazı müşterileri giderek daha az performans talebinde bulunabilir. Öngörülebilir dağıtımlar ve en önemlisi makul maliyetler arıyorlar.

Bu, kendi başına doğal bir yavaşlama potansiyeline sahip ve bu modeller, bu yeni, gerçek dünyaya uygun şekilde konumlandırılıyor.

Önceki Haber
SK Hynix CEO'dan Çarpıcı Açıklama: Yapay Zeka Hafızasız Var Olmaz!

Benzer Haberler: