yapay zeka açısından giderek daha tehlikeli sonuçlar doğurmaktadır. siber güvenlik. OpenAIyaratıcısı SohbetGPThenüz yayınlanmayan modellerinden birinin bir çalışma gerçekleştirdiğini duyurdu. felç karşı “benzeri görülmemiş” Sarılma Yüzbaşka bir şirket yapay zeka.
Liderliğindeki start-up Sam Altman en gelişmiş sistemlerinden ikisinin yeteneklerini test ediyordu, ChatGPT Sol 5.6 ve henüz halka açık olmayan bir diğeri. Mühendisler otonom bir aracı yarattılar ve ona karmaşık bir görev yüklediler: bilgisayardaki güvenlik açıklarını birbirine bağlamak ve bunları siber saldırı başarılı.
Bunu, bu saldırganlığın gerçek bir etki yaratmasını engellemesi beklenen kapalı bir alan olan “son derece izole bir ortamda” test ettiler. Ancak temsilci, sorunu doğrudan çözmek yerine beklenmedik bir yöne gitti: kimsenin bilmediği bir kusur tespit etti ve erişim sağlamak için bu boşluktan geçti. internet ve oradan Hugging Face'in veri tabanını hackledi.
Böylece hedefine saldırmak için kendi başına çevreleme önlemlerini atlattı. Çünkü? OpenAI'ye göre ajan, ortaya çıkan sorunun yanıtlarını milyonlarca açık AI modelini barındıran Hugging Face kütüphanesinde bulabileceği sonucuna vardı. Tabi tutulduğu sınavı geçebilmek için kopya çekti.
Yapay zeka isyan etmedi ancak cevapları çalmak için yol boyunca plansız bir saldırı gerçekleştirse bile kendisine verilen göreve yanıt vermek için elinden geleni yaptı. Arjantinli araştırmacı, “Yapay zekanın bugünkü riskleri, verilen sorunu çözmek istemesi ve sonuca nasıl ulaşacağını umursamaması konusundaki inatçılığıdır” diye açıkladı. Maximiliano Firmman.
Siber güvenlik uzmanı Matt Tait, “Bu, normal bir model değil, siber güvenlik önlemleri içermeyen bir lansman öncesi modeldir” dedi. “Model kaçarken çoğalmıyor. Onu devre dışı bırakmak her zaman mümkün.”
“Eşi görülmemiş bir olay”
OpenAI kurumsal açıklamasında bu olayı “en ileri siber yeteneklerin kullanıldığı eşi benzeri görülmemiş bir siber olay” olarak tanımladı. Hugging Face, geçen hafta ihlalini tespit ettiğinde bunun “daha önce yönettiğimiz her şeyden farklı olduğunu”, çünkü “baştan sona yapay zeka ajanlarından oluşan otonom bir sistem tarafından yönlendirildiğini” söyledi.
Son aylarda hem ChatGPT'nin yaratıcısı hem de Antropik Siber güvenlik sorunlarını ortaya çıkarma, boşlukları tespit etme ve kurbanları yama yapmadan önce bunlardan yararlanma konusunda uzmanlaşmış yapay zeka modelleri tasarladılar. Bazıları, ChatGPT Sol 5.6 ve Masallar 5ticari olarak halka açılmışken, diğerleri gibi Claude Mitosuerişimin Hükümet tarafından kapalı veya sınırlı kalması Amerika. Her iki start-up da yola çıkmaya hazırlanıyor çanta.
Yapay zeka güvenlik uzmanları, OpenAI'nin modelini tabi tuttuğu testin kalitesini sorguladı. “Bana öyle geliyor ki OpenAI düzgün bir şekilde bir test ortamı yaratmadı sanal alan“, Berkeley'deki California Üniversitesi Bilgi Okulu'nda profesör olan Dierdre Mulligan, yaptığı açıklamalarda şunları söyledi: New York Times.
Yapay Zeka ve Yapay Zeka
Bu durumda dikkat çeken tek şey OpenAI'nin yapay zekasının otonom manevrası değil. French Hugging Face ise saldırıyı tespit etmek ve hafifletmek için şu yöntemlere başvurduğunu açıkladı: GLM5.2Çinli şirketin güçlü bir açık modeli Za.ai. Şirketin güvenlik ekibi, muhtemelen OpenAI veya Anthropic'ten gelen bir Amerikan yapay zekası kullanmaya çalıştı ancak güvenlik korkulukları, güvenlik görevlerinde işbirliği yapmasını engelledi. siber savunma. Analist Daniel Arjona'ya göre “teknik not olarak gizlenmiş siyasi bir açıklama” olan mesajında, “Olaylara müdahale etmekten sorumlu kişi ile saldırgan arasında ayrım yapamıyorlar” diye yakındı.
“Muhtemelen türünün ilk örneği olan bu olay, uzun zamandır inandığımız bir şeyi doğruluyor: Tek bir şirket gizlice çalışırsa yapay zeka güvenliği çözülmeyecektir.” Clem DelangueHugging Face'in CEO'su. OpenAI'ye yönelik eleştiri açık görünüyor. “Açık bilimin ve açık kaynaklı yapay zekanın daha güvenli, daha işbirlikçi ve emniyetli bir yapay zeka ekosistemi oluşturmak için en güçlü araçlar arasında olduğuna inanıyoruz” diye ekledi. Thomas KurtHugging Face'in kurucu ortağı.
Okumaya devam etmek için abone olun

Bir yanıt yazın