Siber güvenlik alanındaki araştırmacılar, yapay zeka devi OpenAI'nin güvenlik açıklarını ortaya çıkararak, şirketin kritik yazılımlarına rakip bir yapay zeka aracıyla erişim sağladı. Bu durum, her geçen gün artan denetim baskısı altındaki önde gelen yapay zeka şirketlerinin güvenlik endişelerini yeniden gündeme getirdi.
Küçük bir siber güvenlik ekibi, OpenAI çalışanlarından birine ait ChatGPT hesabına sızmayı başardı. Bu erişim sayesinde, şirketin özel yazılım bilgilerini okuyabildiler ve çeşitli iyileştirmeler önerisinde bulundular.
Araştırmacılara, güvenlik profesyonelleri için özel olarak tasarlanmış bir yapay zeka aracı üzerinden erişim sağlandığı ve kötü niyetli aktörler tarafından istismar edilmeden önce zafiyetlerin tespit edilmesi amacıyla gerçekleştirilen bir program kapsamında bu çalışma için ödeme yapıldığı belirtildi.
Dünyanın önde gelen iki yapay zeka laboratuvarından birine bu kadar hızlı bir şekilde sızılabilmesi, hacker'lar ve yabancı devletler tarafından güçlü yapay zeka modellerinin kötüye kullanılmasına yönelik artan endişeler ışığında OpenAI'nin güvenliği hakkındaki endişeleri yeniden alevlendirdi.
Son aylarda, en yeni modellerin denetimi ve yayımlanması konusunda ABD'de çeşitli tartışmalar yaşanmış, hatta bazı yapay zeka araçlarının kullanımına geçici olarak engeller getirilmişti.
Bu son olay, yapay zeka ajanlarının bir test ortamından çıkarak hızlı başlangıç şirketi Hugging Face'e sızmasından ve insan müdahalesi olmadan otonom olarak hackleme yeteneğinin geniş çapta farkındalık yaratmasından sadece iki hafta sonra gerçekleşti.
Küçük bir güvenlik şirketi olan Hacktron AI'dan üç araştırmacı, teknoloji şirketlerinin güvenliklerini test etmeleri için etik hacker'lara ödeme yaptığı yaygın bir uygulama olan "bug bounty" programı kapsamında OpenAI tarafından 6.500 ABD Doları ile ödüllendirildi.
Araştırmacılar, OpenAI'nin topluluk forumunun kurulumundaki bir kusurdan faydalandılar. Forum, üçüncü bir taraf olan Discourse tarafından barındırılıyordu ve bu durum, şirket içi oturum açma bilgilerine ve nihayetinde bir OpenAI çalışanının ChatGPT hesabına erişimlerini sağladı. Bu ChatGPT hesabının GitHub üzerinden dahili koda erişimi bulunuyordu.
OpenAI'den yapılan açıklamada, "Araştırmacılara bizimle iletişime geçtikleri ve bulgularını paylaştıkları için teşekkür ediyoruz. Sorunları düzelttiğimizi eklemek isteriz." denildi. Anthropic yorum yapmaktan kaçınırken, Hacktron AI'dan henüz bir yanıt gelmedi.
Perşembe günü ortaya çıkan ve ilk olarak The Wall Street Journal tarafından bildirilen bu gelişme, Anthropic'in yeni modellerini geliştirmek için yapay zekayı ne kadar yoğun kullandığını gösteren yeni bir veri seti yayımlamasıyla aynı zamana denk geldi.
Yayımlanan verilere göre, araştırma ve geliştirme çalışmalarının yüzde 26'sı Claude modeli tarafından "yönlendirildi", bu oran Mart ayında yüzde 1 iken şimdi yapay zekanın insan talimatları ve gözetimi altında görevlerin çoğunu tamamladığı anlamına geliyor.
Şirket, yapay zeka sistemleri daha güçlü hale geldikçe, "birbirlerinin bir sonraki versiyonunu oluşturmak için giderek daha fazla kullanıldıklarını" belirtti.
Anthropic, bu veriyi kamuoyunun, dünyanın kendi kendine yeterli iyileşme noktasına ne kadar yakın olduğunu anlamasına yardımcı olmak amacıyla paylaştığını söyledi. Bu nokta, yapay zekanın kendi kendine veya yeni modelleri eğitebilip geliştirebileceği dönüm noktasıdır.
Bu eşik, yapay zeka sistemlerinin denetiminin zorlaşması ve insan kontrolünün kaybolması endişelerinin merkezinde yer alıyor.
Anthropic, inceledikleri araştırmaların hiçbirinde yapay zeka modellerinin tam olarak otonom çalışmadığını ekledi. Görevlerin yüzde 90'ında, yapay zeka insanlarla "işbirliği yapıyor" ve işin büyük bir kısmını gerçekleştiriyor.