Yapay zeka şirketlerinin telif hakkı ve kullanıcı gizliliği gibi alanlarda sicilleri pek parlak değil. Ancak, ChatGPT gibi platformlardan alınan sohbet kayıtlarının modelleri iyileştirmek için kullanıldığı genel olarak biliniyor. Bu sürecin nasıl işlediği ise bugün daha net bir şekilde ortaya çıktı. Yapılan bir habere göre, OpenAI, sohbet günlüklerini incelemek üzere yüzlerce yüklenici çalıştırmış ve bu incelemeler sırasında kişisel bilgilerin de yer aldığı durumlar yaşanmış.
OpenAI'deki bu değerlendirme projesinin adı 'Proje Lilly'. Elde edilen bilgilere göre, proje yöneticileri 'prompt reviewer' olarak adlandırılan kişileri görevlendiriyor. Bu kişilerin temel görevi, anonimleştirilmiş gerçek sohbetleri inceleyerek ChatGPT'nin yanıtlarının kalitesini değerlendirmek. Yanıtların soruyu doğru yanıtlayıp yanıtlamadığı, yapay zeka dilinden kaçınılıp kaçınılmadığı, küçümseyici veya aşırı samimi bir ton kullanılıp kullanılmadığı gibi çeşitli kriterlere bakılıyor. Ayrıca, ChatGPT'nin kişisel deneyimler yaşamış gibi konuşması da istenmiyor.
Bu işin oldukça basit ancak saatlik 50 doların üzerinde bir ücretle yapıldığı belirtiliyor. Ancak, gözden geçirenlerin belirttiğine göre, talimatlar sürekli değişiyor ve çelişkili olabiliyor. Bu durum, birçok yazılım geliştiricinin de aşina olduğu bir his.
İncelemeyi yapanlar, çoğu kullanıcının sohbetlerinin başkaları tarafından okunduğunun farkında olmadığını düşünüyor. Bu durum, birçok kişinin ChatGPT'yi bir arkadaş veya terapist gibi kullanarak derin sırlarını paylaştığı göz önüne alındığında özellikle endişe verici.
Sohbetlerin anonimleştirme aşamasından geçtiği ve inceleyicilerin kullanıcı adlarını görmediği iddia edilse de, OpenAI, bazen, özellikle kısa sohbetlerde kişisel verilerin sızabileceğini kabul ediyor. Raporda ayrıca, birçok konuşmada kullanıcının ChatGPT'den içeriği gizli tutmasını istediği de belirtiliyor. İnceleyicilere sunulan sohbet versiyonunda, kullanıcının sorularının, ilgi alanlarının, bağlamının ve hatta konumunun özetini içeren bir 'kullanıcı anıları özeti' de bulunuyor.
Proje Lilly, sohbetlerin gerçek doğruluğunu doğrudan incelemiyor, yalnızca bariz hataları işaretliyor. Bu da, muhtemelen başka ekiplerin de bu tür değerlendirmeler yaptığını gösteriyor. Ayrıca, bu incelemeler, birinin başkasına zarar verme niyetini veya kendine zarar verme eğilimini belirlemeye yönelik manuel güvenlik kontrollerinden ayrı tutuluyor.
Projenin varlığı, bazı yapay zeka şirketlerinin yarattığı imajın aksine, modellerin yalnızca teknolojik ilerleme ve daha iyi veri setleriyle gelişmediğini gösteriyor. Görünüşe göre, işin içinde hala yetkin insanlara ihtiyaç var.
Peki, çoğu sohbet robotunda bulunan ve "sohbetlerinizi ürünümüzü iyileştirmek için kullanmamıza izin verin" ayarı ne anlama geliyor? Bildiğimiz kadarıyla bu ayar, birçok ücretli plan dahil olmak üzere çoğu kullanıcı odaklı sohbet robotunda varsayılan olarak açıktır. ChatGPT'de ise Kurumsal, İş ve Eğitim müşterilerinde varsayılan olarak kapalıdır.
Bu ayarın geçmişe yönelik bir etkisi olmadığını, yani ChatGPT'nin veritabanında zaten bulunan sohbetlerin, kullanıcı silme talebinde bulunmadıkça orada kalacağını unutmamak gerekir. Ayrıca, silinen sohbetler de geriye dönük işlemeyecek, yani silinmiş sohbetler zaten işlenmiş, anonimleştirilmiş ve bir veri kümesinde yer alıyor olabilir.
OpenAI başlangıçta, kullanıcıların sohbetlerinin insanlar tarafından okunabileceği konusunda açıkça bilgilendirilip bilgilendirilmediği sorusuna yanıt vermemiş olsa da, şirketin daha sonra modelleri iyileştirme amacıyla insan incelemesini tartıştığı SSS sayfalarından birine bir bağlantı sunduğu bildirildi. Bu bildirimin en az iki yaşında olduğu ve muhtemelen daha eski olduğu doğrulandı. Haberlerin yayınlanmasının ardından şirket, veri toplama dışı kalma yollarını açıklayan yardım sayfasını değiştirdi, ancak bu metinde insan operatörlerden bahsedilmiyor.
Bu tür veri toplama ve inceleme, çoğu sağlayıcıda süregelen bir tema. Google Gemini'nin Gizlilik Merkezi'nde "insanların bazı kayıtlı sohbetleri inceleyebileceği" açıkça belirtiliyor. Anthropic'in yaklaşımı da benzer ve bu konuya adanmış bir sayfa bulunuyor. Perplexity'nin durumu ise daha belirsiz, zira Gizlilik Bildirimi sohbet günlüklerine insan erişimini onaylamıyor veya reddetmiyor.