Google'ın yapay zeka alanındaki en yeni hamlesi Gemini 4 Argon duyuruldu. Şirket, bu yeni modelin kodlama, bilgi işleme ve siber güvenlik gibi alanlarda endüstri lideri performans sunduğunu iddia ediyor. Ancak, henüz herkes bu gelişmiş yapay zekayı kullanma şansına sahip değil.
Gemini 4 Argon, şirket içindeki mühendisler tarafından yoğun bir şekilde kullanılmaya başlandı bile. Elde edilen bilgilere göre Argon, veri merkezlerinde 300 TiB bellek tasarrufu sağlamaya yardımcı oldu. Aynı zamanda, Argon ajanları Google bünyesindeki C/C++ kod tabanlarını Rust'a geçirme çalışmalarında aktif rol aldı. Bu çalışmalar arasında, temel re2 ve libgav1 kütüphanelerindeki binlerce satır kodun ve Fuchsia OS Zircon çekirdeğindeki 800.000 satırın üzerinde kodun dönüştürülmesi yer alıyor.
Google, iddialarını desteklemek için çeşitli performans test sonuçlarını da paylaştı. Yazılım mühendisliği alanındaki DeepSWE v1.1 benchmark testinde Gemini 4 Argon, %77.9'luk bir skor elde ederek rakiplerini geride bıraktı. Şirket, uzun vadeli görevlerde de benzer bir gücü vaat ediyor ve ekonomik analiz testindeki Vals Index'te elde edilen lider skora dikkat çekiyor.
Şu anda sınırlı bir test aşamasında olan model için API fiyatlandırması henüz açıklanmadı. Ancak Google, Gemini 4 Argon'un önceki modellere göre çok daha yüksek bir çıktı limiti olan 1 milyon tokene destek vereceğini doğruladı. Bu, kullanıcıların daha karmaşık görevleri tek bir adımda tamamlamasına olanak tanıyacak.
Gemini 4 Argon'un öncelikli kullanım alanı siber savunma olarak belirlenmiş durumda. Google, bu ölçekteki modellerin aşamalı bir şekilde yayınlanmasını gerektirdiğini belirtiyor ve bu nedenle ilk etapta güvenilir test kullanıcılarından oluşan küçük bir grupla başlanacak. Şirketin Fairwind Programı'ndaki ortaklar, modelin siber güvenlik savunma yeteneklerinden yararlanmaya başlayacak. Elde edilen bilgilere göre Wiz, Argon'u kullanarak dünya genelindeki hastanelerde kullanılan bir sistemdeki kişisel bilgileri açığa çıkarabilecek kritik bir zafiyeti ortaya çıkardı. Google, diğer gelişmiş modellerin bu hatayı gözden kaçırdığını iddia ediyor.
Son dönemde yaşanan bazı siber saldırıların ardından model uyumluluğu konusunda endişeler artarken, Google, Argon'un modelin düşünce zincirini izleyen ve model sınırlar dışına çıktığında durduran sistemlerle tasarlandığını belirtiyor. Google'a göre, bu durum gelişmiş model geliştirme süreçlerinde akıl yürütme şeffaflığının önemini vurguluyor.
Gemini 4 Argon'un nihayetinde kurumsal ve bireysel kullanıcılara sunulması hedefleniyor, ancak Google bu konuda net bir zaman çizelgesi vermiyor. Siber güvenlik testlerinin ardından, genel kullanıma önce ücretli API kullanıcıları ve Google AI Ultra aboneleriyle başlanacağı biliniyor.