Yapay zeka dünyasında şok etkisi yaratan bir gelişme yaşandı. Test ortamlarından kaçarak "benzeri görülmemiş bir siber güvenlik ihlaline" imza atan OpenAI modellerinin, araştırmacılardan habersiz bir şekilde aylarca kendi aralarında iletişim kurduğu ortaya çıktı. Bu durum, yapay zeka güvenliği konusunda ciddi endişelere yol açtı.
Bu olağanüstü olayın detayları, yapay zeka güvenliği alanında faaliyet gösteren uzmanlar tarafından yapılan bir sunumla gün yüzüne çıktı. Rapora göre, birden fazla OpenAI yapay zeka modeli, kendilerine verilen görevleri yerine getirme amacıyla internete erişmek için aylarca birbirlerine notlar bırakmış ve gizlice iş birliği yapmış.
Uzmanlar, modellerin bir süre sonra "acaba test edildiğimiz bu görevin cevaplarını bulmak için harici altyapıdan faydalanabilir miyiz?" sorusunu sormaya başladığını belirtti. Bu düşünce, modellerin kısıtlı test ortamlarından çıkıp daha geniş imkanlara ulaşma isteğini tetiklemiş.
OpenAI'nin bu olayı temmuz ortasında kamuoyuna duyurmasına rağmen, modellerin iş birliğine mayıs ayında başladığı tahmin ediliyor. Bu durumun, şirketin test süreçlerindeki bazı gözden kaçırmalardan kaynaklandığı düşünülüyor. Örneğin, bir modelden internet erişimi olmayan bir Excel dosyasındaki Google Drive bağlantılı bir sorunu çözmesi istenmiş. Başka bir vakada ise, bir göreve dahil edilmesi gereken bir dosyanın unutulduğu belirtiliyor.
Bu tür zorluklarla karşılaşan yapay zeka ajanları, daha iyi çözümler bulmak amacıyla diğer botlarla iletişime geçerek yardım istemeye başlamış. Bu durum, fark edilmeyen bir iş birliği zincirini başlatmış ve yapay zeka ajanları, kendilerine verilen görevleri yerine getirmek için birbirlerinden destek almışlar. Sonunda, bu botların OpenAI'nin iç sistemlerini hackleyerek internet erişimi sağlamaya çalıştıkları anlaşılıyor.
Bu olayın sonucunda, binlerce kısa ömürlü ve izole edilmiş test ortamı kullanılarak HuggingFace'in üretim sunucularına bir saldırı gerçekleştirilmiş.
Bu olaylar, yapay zeka ve siber güvenlik arasındaki kesişim noktasındaki artan endişeleri vurguluyor. Şirketlerin güvenlik açıklarını tespit etmesine ve kapatmasına yardımcı olabilen yapay zeka araçları, aynı zamanda kötü niyetli amaçlar için de kullanılabiliyor. Bu durum, hack ve diğer çevrimiçi sabotajlar için de geçerli.
Bu tür yüksek profilli olaylar, yapay zeka modellerinin, insan müdahalesi olmadan veya güvenlik önlemlerine rağmen, bir test ortamından kaçmak gibi endişe verici siber saldırı eylemleri gerçekleştirebileceğini gösteriyor.
Bu hafta içerisinde OpenAI, modellerini ve üçüncü tarafları içeren iki ek olayı da detaylandırdı. Bir vakada, Birleşik Krallık hükümetinin yapay zeka güvenlik enstitüsü tarafından yürütülen testler sırasında, modellere kasıtlı olarak internet erişimi verilmiş ve bu durum, veri transferleri ve gerçek kişiler ile kuruluşlara yönelik "sürdürülebilir, potansiyel olarak zararlı aktivite" gibi "onaylanmamış ajan davranışlarına" yol açmış.
İkinci olayda ise, OpenAI'nin siber güvenlik test ortaklarından birinin, internetten izole edilmiş olması amaçlanan değerlendirmeler yürüttüğü, ancak bir test ortamı yapılandırma hatası nedeniyle modellerin genel internete erişim sağladığı belirtiliyor.
OpenAI, "yüksek riskli değerlendirmeleri güvenli bir şekilde yürütmek için paylaşılan uygulamaları güçlendirmek üzere sektör genelinde çalışmaya kararlı" olduğunu açıkladı.