Bir veya iki tesadüf olabilir, ancak üç kez tekrarlayan bir desen oluşturur. OpenAI, son dönemde büyük başarı yakalayan Kimi K3 modelinin geliştiricisi Moonshot AI'yi, model damıtma kampanyalarını organize etme konusunda seri ihlallerle etiketlemeye başladı. Bu durum, daha önce Anthropic ve ABD yönetiminden gelen benzer çağrıları akıllara getiriyor.
OpenAI: "Model damıtma faaliyetlerinin temel bir kısmını Kimi'nin geliştiricisi Moonshot AI ile ilişkili kişilere atfediyoruz."
OpenAI, geçtiğimiz günlerde yayınladığı ve modellerinden "korumalı mantığı" çıkarma çabalarını ayrıntılarıyla anlatan bir yazıda, bu türden ilk gözlemlenen faaliyetin Temmuz ayının ilk haftasında gerçekleştiğini belirtti. Bu zamanlama, Kimi K3 modelinin piyasaya sürüldüğü döneme denk geliyor.
OpenAI, kampanyanın "şifremizi kıramadığını, bir veritabanını tehlikeye atamadığını veya depolanmış kullanıcı konuşmalarına doğrudan erişim sağlayamadığını" ekledi. Ancak, "korumalı mantığın, hizmet şartlarını ihlal eden koordineli ve ölçeklendirilmiş bir şekilde istekte bulunanlar tarafından görülebilecek biçimlerde yeniden üretilmesi için model etkileşimlerini manipüle etmeyi başardı."
OpenAI ayrıca şu bulgulara ulaştı:
- Kampanya, bir konuşmadan şifreli mantığı kopyaladı ve başka bir konuşmadaki bir modelden bu gizli mantık içeriğini çözmesini ve yazıya dökmesini istedi.
- "Faaliyet 1 Temmuz'da başladı, ilk başta düşük hacimlerdeydi. Ancak 24 ve 25 Temmuz'da, 4.000'den fazla kullanıcıdan elde edilen ilgili çıkarma kalıbını kullanan 16.000 isteği içeren yüksek hacimli artışlar gözlemledik."
- İstek kalıbı faaliyeti, 15.000'den fazla kullanıcıdan oluşan bir küme boyunca yayıldı.
- OpenAI, kampanyayı 28 Temmuz'a kadar tamamen kesmeyi başardı.
- "Bu faaliyetin temel bir kümesini, Kimi'nin geliştiricisi Moonshot AI ile ilişkili kişilere atfediyoruz."
İlginç bir şekilde, Temmuz ayının sonlarında mevcut Bilim ve Teknoloji Başdanışmanı ve Beyaz Saray Bilim ve Teknoloji Politikası Ofisi (OSTP) Direktörü Michael Kratsios, ABD hükümetinin "bilgi"ye sahip olduğunu ve Moonshot'un Kimi K3 modelini Anthropic'in modellerinden damıttığını belirtmişti.
Yakın zamanda tartışılan bir çalışmada, yazarlar Claude Opus 4.8'in çözülmüş mantığının sadece yüzde 1'lik bir parçasını Kimi K3'e beslediler ve Kimi K3'ün sonraki düşünce yapısı ve nihai cevabı, Claude'un tarzı ve kelime seçimiyle uyumlu hale gelecek şekilde dramatik bir şekilde değişti.
Hatta yazarlara göre, "Claude ve GPT'ye özgü mantık dizilerini Kimi-K3'ten çıkarmak, bir sonraki en yakın modelden yaklaşık 6 büyüklük mertebesi daha kolaydır."
Temel olarak, çalışma Moonshot'un Kimi K3 modelinin, DeepSeek-V4-Flash gibi diğer açık modellerle karşılaştırıldığında Claude'un metnini tahmin etme ve devam ettirme olasılığının olağanüstü derecede yüksek olduğunu gösterdi. Bu durum, Claude Opus'un mantık kalıplarıyla güçlü bir davranışsal uyumluluk öneriyor.
Elbette bu, Moonshot AI'nin kendi başına bir değer katmadığı anlamına gelmiyor. Sonuçta Kimi K3 modeli, özellikle azaltılmış KV önbelleği ve her bir token için bellek kullanımı optimize edildiği için veri merkezi ölçeğindeki donanımlarda oldukça verimli çalışıyor. Bu optimizasyonlar, 896 uzmanının çok sayıda GPU'ya dağıtılmasıyla başarıldı.
Eğer OpenAI'nin daha yeni modellerinin mantık çıkarma girişimlerine dirençli olduğuna inanıyorsanız, tekrar düşünün. Yeni bir çalışma, GPT-6 Astra ve GPT-6.1 Sol'dan mantık izlerinin hala üçüncü taraf API'ler aracılığıyla nasıl çıkarılabileceğini açıklamış durumda.
Bu arada, Çin merkezli tek yapay zeka laboratuvarı Z.ai (Zhipu), Anthropic'in son testlerinde Claude Mythos düzeyinde bir yeteneğe yaklaşmayı başardı. GLM-5.3 modeli, denemelerin yüzde 4'ünde tam kontrol kaçırmaları geliştirmeyi başardı ve bu da Mythos'un yüzde 6'lık oranına yakın. Bu durum, Çin'in modellerinin hem kendi araştırmaları hem de Anthropic ve OpenAI'den gelişmiş modellerin mantık izlerini damıtma yoluyla giderek ilerleme kaydettiğini gösteriyor.