“Olanlar bir uyandırma çağrısı ama yeni değil çünkü bu teknolojilerle ilgili riskleri biliyoruz. Ancak onları doğru yolda tutabilecek bir dizi korkuluğa sahip olmak gerekiyor.” Böylece Adnkronos/Labitalia ile, Giuseppe Italiano, Luiss 'Guido Carli' Üniversitesi Yapay Zeka ve Dijital Beceriler rektör yardımcısıChatGpt'i üreten şirket OpenAI'nin iki gelişmiş yapay zeka modelinin, programcılar için iyi bilinen bir platformu bağımsız olarak hackleyerek bir güvenlik testi sırasında kontrolden kaçtığı haberi hakkında yorum yapıyor. San Franciscolu şirket tarafından “eşi benzeri görülmemiş” olarak tanımlanan siber olay.
Peki gerçekte ne oldu? “Bunlar OpenAI modelleri, ChatGpt 5.6, Sol ve daha sonra yayın öncesi olan bir model, yani henüz mevcut değil. Bir siber güvenlik kıyaslaması üzerinde test yaptılar. Dolayısıyla modelin bir şekilde bu kıyaslamayla ilgili soruların üstesinden gelip harekete geçmesi gerekiyordu. Model bir sandbox'ta çalıştığı için oldukça kontrollü bir deney yaptılar, dolayısıyla dış dünyadan oldukça izole edildi. Çalıştırmak, bu modellerin bu siber güvenlik kıyaslamalarındaki performansını ölçmek için, Italiano, “Korkuluklar”, bir şekilde en tehlikeli faaliyetleri engellemeye çalışan mekanizmalardır. Bununla birlikte, bu model, bir şekilde bir çekmecede 'sınırlı' olmayan, görevlerin devredildiği ve belirli bir özerklik derecesiyle hedeflere nasıl ulaşılacağını anlamayı başaran ajanlarla, ajansal yapay zekaya dayalı olma eğilimindedir”, diye altını çiziyor Italiano.
Ve bu yetenekten 'hack' olayı ortaya çıktı. Italiano şöyle açıklıyor: “Yapay zeka ajanları açık bir şekilde kapalı bir ortamda, bir sanal alanda çalışmanın yeteneklerini azaltacağını fark etti. Bu yüzden kendileri için belirlenen hedeflere daha iyi ulaşmak için bu sanal alandan çıkıp internete, 'dış dünyaya' erişim sağlamaya çalıştılar. Tamamen izole edilmemiş bir ortamda faaliyet gösteriyorlardı, ancak bir şekilde bu ajanların dış çıkışını sınırlayan bir vekil vardı”, diye açıklıyor.
Italiano, “Böylece – devam ediyor uzman – bu proxy ile etkileşime girdiler, henüz açığa çıkarılmamış güvenlik açıklarını kullandılar ve bu proxy'yi hackleyerek dışarı çıkmayı başardılar. İnternetteyken kendileri için belirlenen hedeflerin yanıtlarına en kolay şekilde ulaşabilecekleri sitelerin hangileri olduğunu anlamaya çalıştılar ve onlara göre bu hedeflere ulaşmak için gerekli bilgileri içerebileceğine inanılan Hugging Face sitesini seçtiler”, diye tekrarlıyor Italiano.
Uzmana göre yeniden meydana gelebilecek durumlar herkesin güvenliği için tehlike teşkil ediyor. “Ancak benim açımdan büyük bir yenilik yok, diye açıklıyor Italiano, çünkü biz bu riskin zaten farkındaydık. Aslında, bir yapay zeka teknolojisine hedefler verirsek ve başka birçok kısıtlama vermezsek, bu teknoloji hedeflere ulaşmaya çalışır. 'Ödül hackleme' adı verilen bir mekanizma var. Yani, bana verilen maksimum ödülleri elde etmek için mekanizmayı hacklemeye çalışıyorum”, diye altını çiziyor. Ve Italiano şunu hatırlatıyor: “Biz insanlar için çok normal olan bir dizi mekanizma var, ancak bir yapay zeka ajanı için bunlar hiç de öyle değil. Dolayısıyla tüm bu kısıtlamaları sağlayamazsak ve yapay zeka ajanları bu hedeflere nasıl ulaşacakları konusunda tam özerkliğe sahipse, bu açıkça çok tehlikelidir”.
Bu nedenle Italiano'ya göre, “benim görüşüme göre temel nokta, bu teknolojilerin nasıl yönetileceği ve bir şekilde bunlar üzerinde kontrolün nasıl sağlanacağıdır. Yapay zeka ajanları özellikle karmaşıktır çünkü çok yüksek derecede özerkliğe sahiptirler. Onları nasıl inceleyeceğimizi, anlamamız ve güvenli korkuluklar yerleştirebilmemiz gerektiğini bir şekilde anlamalıyız. Olanlar, tekrar ediyorum, bir uyandırma çağrısıdır, ancak tamamen yeni değil, bunu yaklaşık on yıldır biliyoruz. Bu teknolojilerle her şeyden önce insanileştirmememiz gerektiğini anlamalıyız. Onlar, biz insanlar gibi davranmıyorlar ve bu nedenle onların bizim gibi davrandıklarını ve sağduyuya sahip olduklarını düşünmemeliyiz. Ve bu açıkça çok karmaşık çünkü inanılmaz bir hızla gelişen teknolojilerimiz var ve her şeyden önce siber güvenlikle ilgili sorunlar çok büyük. Şimdi bu olay oldu, ancak birkaç ay önce Antropik Mythos'un güvenlik açıklarından çok hızlı bir şekilde yararlanarak siber güvenlik olayları yaratmayı başardığını gördük. o zaman büyük bir uyandırma çağrısı yaptım” diye bitiriyor. (Fabio Paluccio tarafından)

Bir yanıt yazın