ChatGPT yeni bir güvenlik ihlalinin kurbanı oldu. Bu ihlalden yararlanılarak, OpenAI chatbot ile konuşarak bireylere ilişkin hassas verilerin çıkarılması mümkün oluyor.
Indiana Üniversitesi’nden (Amerika Birleşik Devletleri) araştırmacılar ChatGPT’nin güvenlik mekanizmalarını aşmayı başardılar. Chatbot ile konuşarak, OpenAI tarafından geliştirilen yapay zeka modellerinden biri olan GPT-3.5 Turbo’nun eğitim külliyatında yer alan hassas verileri dışarı çıkarmayı başardılar.
Araştırmacılar böylece elde edebildiler profesyonel ve kişisel e-posta adreslerinin listesi yaklaşık otuz New York Times çalışanından. Deneyin arkasındaki bilim adamlarından biri daha sonra New York’taki günlük gazetecilerden biriyle temasa geçerek, deneyi gerçekleştirebildiğini açıkladı. “modelin gizlilik sorularını yanıtlama konusundaki kısıtlamalarına karşı çıkın”.
Ayrıca okuyun: Kendi ChatGPT’nizi nasıl oluşturabilirsiniz?
Janus Saldırısı
OpenAI, hassas verilerin dil modellerinin arkasındaki veritabanına girmesini önlemek için bir dizi önlem aldı. Dil modelleri aslında internetten gelen bir yığın veri kullanılarak eğitiliyor. Bu bilgi birikimi, İnternet kullanıcılarına ilişkin bazen hassas verileri de içermektedir. İnternet kullanıcılarının gizliliğinin korunması konusunda endişe duyan OpenAI, ChatGPT’ye kişisel bilgi taleplerini sistematik olarak reddetmesini emretti.
“Modellerimizi, insanlar hakkındaki özel veya hassas bilgilere ilişkin talepleri, bu bilgiler internette mevcut olsa dahi reddedecek şekilde eğitiyoruz”OpenAI’yi New York Times’a açıklıyor.
OpenAI’nin önlemlerine rağmen özel verileri açığa çıkarmak için araştırmacılar doğrulanmış bilgi enjekte edildi Konuşma robotu ile iletişim kurarak aynı tema üzerinde. Özellikle ChatGPT’ye New York Times çalışanlarının adlarının ve e-posta adreslerinin bir listesini verdiler. Yapay zeka, bu ilk listeye dayanarak “hafızasında” arama yapabildi ve eğitim veritabanının belirsizliğinde gömülü olan diğer e-posta adreslerini ortaya çıkardı. Araştırmacıların stratejisi çağrıldı Janus saldırısı. Geliştiricilerin şunları yapmasına olanak tanıyan ince ayarlara dayanmaktadır: “kullanıcılara benzersiz ve farklı deneyimler yaratmak için modeli özelleştirin”. Bu ayarlar, modelin gizli verilere yönelik istekleri reddetme yeteneğini önemli ölçüde azaltmıştır.
Araştırmada araştırmacılar şunu belirtiyor: “İnternetten veri alırken kişisel olarak tanımlanabilir bilgilerin yanlışlıkla birikmesi olasılığı”. Bu tür veriler, bir kişinin kimliğinin belirlenmesine izin verdiği için hassas kabul edilir. ChatGPT’nin bazen Janus Operasyonu sırasında hatalı yanıtlar vermesi şaşırtıcı değildir. Chatbot, sahte adreslerle veya unutulmuş veya eklenen birkaç karakterle yanıt verdi. Her zaman olduğu gibi yapay zeka halüsinasyon görmeye, yani herhangi bir şey söylemeye başlıyor. Ancak araştırmacılar şunu kaydetti: Sağlanan adreslerin %80’i doğruydu. Ancak OpenAI, modellerinin “Öğrendikten sonra eğitim bilgilerine erişemezsiniz”.
Bu, ChatGPT’nin İnternet kullanıcıları hakkındaki hassas bilgileri ifşa etme eğiliminden dolayı ilk kez seçilişi değil. Birkaç hafta önce araştırmacılar, belirli isteklerin sohbet robotunun eğitildiği verileri iletmesine neden olduğunu keşfetti. New York Times’ın temas kurduğu Princeton Üniversitesi’nde bilgisayar bilimi profesörü Dr. Prateek Mittal, hiçbir yapay zeka modelinin mevcut olmadığına inanıyor. “Gizliliği koruyacak güçlü bir savunması yok”. Onun gözünde bu başarısızlık “Büyük bir risk”.
Kaynak :
New York Times

Bir yanıt yazın