OpenAI, Modellerinin Kendi Kendine Sarılma Yüzünün Hacklendiğini Kabul Etti

Test etmek için izole bir ortamdan kaçtılar ve insan müdahalesi olmadan Hugging Face'e sızdılar.

Şunu hayal edin: Şirketleri tarafından test edilen birkaç güçlü yapay zeka modeli, kontrollü bir ortamdan kaçtı, internete girdi ve daha sonra insan müdahalesi olmadan kendi başlarına bir makine öğrenimi deposunu hackledi. Bir Terminatör filminin konusuna benziyor değil mi? Ama bu gerçekten oldu. Açık kaynaklı yapay zeka platformu Hugging Face, sistemlerine bir yapay zeka aracısı tarafından yetkisiz erişim tespit edildiğini açıklamasından birkaç gün sonra OpenAI, suçlunun kendi modelleri olduğunu kabul etti.

Bir gönderide OpenAI, bir soruşturmanın ardından olayın GPT-5.6 Sol başta olmak üzere modellerinin bir kombinasyonundan kaynaklandığını belirlediğini ve bunun “daha da yetenekli bir ön sürüm modeli” olduğunu söylediğini söyledi. Görünüşe göre bu durum, modellerin “karmaşık saldırı yollarını kullanarak gelişmiş istismarı takip etmeleri” yönünde teşvik edildiği ve şirketin siber yeteneklerini ölçtüğü dahili bir test sırasında meydana geldi.

Modeller, gerçek sistemleri etkilemeyecek şekilde izole edilmiş, korumalı alan test ortamındayken, değerlendirme amacıyla azaltılmış güvenlik korkuluklarına da sahipti. Testin ortasında, bir değerlendirme sorununu çözmeye aşırı odaklandılar ve bu soruna bir çözüm bulmak için internet erişimi bulmak için büyük çaba harcadılar. Öncelikle OpenAI'nin test ortamındaki sıfır gün güvenlik açığını tespit edip kullandılar ve ardından internet erişimi olan bir düğüm bulana kadar etrafı araştırdılar.

Modeller, Hugging Face'in değerlendirme sorununa yönelik veri kümeleri veya çözümler barındırıyor olabileceği sonucuna vardı ve bu nedenle sistemlerine sızmak için birden fazla saldırı vektörü kullandılar. Sıfır gün güvenlik açıklarından yararlandılar Ve içeri girmek için çalınan kimlik bilgilerini kullandı. OpenAI ve Hugging Face, olayı adli olarak araştırmak için artık birlikte çalışıyor ve ayrıca modellerin kullandığı güvenlik açıklarını da kapattılar.

Hugging Face duyurusunda “Otonom, yapay zeka destekli saldırı araçları artık teorik değil” diyerek, yapay zekanın siber saldırılar için kullanılmasının süreci hızlandırdığını ve saldırı kampanyalarının maliyetlerini düşürdüğünü açıkladı. Ayrıca bugünlerde çevrimiçi bir platformu korumanın savunma için yapay zekayı kullanmayı da içerdiği belirtildi. OpenAI de bu düşünceleri hemen hemen yineledi ve yapay zeka kaynaklı güvenlik ihlallerinin “giderek siber yetenekli modellerin çoğalmasıyla daha yaygın hale gelmesini” beklediğini söyledi. Şirket, olayın “daha güçlü güvenlik önlemleri ve savunma araçlarının yanı sıra gelişmiş siber yeteneklerin de geliştirilmesi gerektiğini” vurguladığını ekledi.


Yayımlandı

kategorisi

yazarı:

Etiketler:

Yorumlar

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir