Yapay zeka tarafından oluşturulan videolar giderek daha gerçekçi hale geliyor. c't 3003 testi gerçekleştirdi ve ekibini, gerçek kayıtların ve mevcut yapay zeka araçlarından oluşturulan oluşturmanın bir karışımı olan 15 kliple karşılaştırdı. Sonuç, eğitimli gözlerin bile bazen hata yaptığını gösteriyor.
Duyurudan sonra devamını okuyun
Videonun transkripsiyonu
(Not: Bu transkript yukarıdaki videoyu izleyemeyen veya izlemek istemeyen kişiler için hazırlanmıştır. Metin, görsel parçadaki tüm bilgileri içermemektedir. Ayrıca burada okunacak videodan sadece bir alıntı bulunmaktadır. Tahmin kısmı yalnızca videonun kendisinde mevcuttur.)
Bakın bu video yapay zeka tarafından oluşturulmuştur. Tabii ben söylemeseydim anlayacaktın ama bu durumda çok daha zor, değil mi? Yapay zeka videoları son aylarda kesinlikle önemli ölçüde gelişti. Tıpkı yapay zeka sesleri gibi, çünkü bu benim gerçek sesim değil, yapay zeka sesimin klonuydu. Evet, bunların hepsi oldukça kafa karıştırıcı ve açıkçası potansiyel olarak tehlikeli. Yapay zeka sahtekarlıkları zaten sosyal medyada her yerde mevcut. Sorumuz şuydu: Yapay zeka destekli videoların sahte olduğu hâlâ kolaylıkla kolayca anlaşılabiliyor mu, yoksa bu süreç çoktan bitti mi? Ve düşündüm ki, eğer başkası farkı anlayabilirse, umarım c't 3003'teki meslektaşlarım da buradadır. İşte bu yüzden bir test hazırladım: Yapay zeka ile ilgili bazı videolar gerçek kamera görüntüleri ile karıştırıldı ve Şahin, Chris ve Keno artık bunları sizinle birlikte izliyor ve yapay zekayı tanımaya çalışıyor. Tahmin edebilirsiniz ve sonunda size gelecekte yapay zeka tarafından oluşturulan içeriği güvenilir bir şekilde tanımak için kullanabileceğiniz bazı iyi ipuçları ve püf noktaları vereceğim. O halde bizi izlemeye devam edin!
Sevgili bilgisayar korsanları, sevgili internet kullanıcıları, buraya hoş geldiniz…
Ücret kısmı sadece videoda görülebilmektedir.
Kimin en iyi tahminde bulunduğuna geçmeden önce, şimdi size özellikle 2026'da yapay zeka videolarını nasıl tanıyabileceğinizi göstereceğim. Çünkü evet, bu hâlâ mümkün. Modeller gelişse bile bazı ipuçları size kesinlikle yardımcı olacaktır.
En büyük kısımla başlayalım: fizik. Kling veya Google Veo gibi bir yapay zeka, yer çekimini veya ağırlığı bilmiyor; yalnızca hangi pikselin bir sonraki sırada gelme ihtimalinin yüksek olduğunu hesaplıyor. Bunun en güzel örneği balıkçımızın suya düşmesiydi. Düşmeyecek, sanki görünmez ipliklerin üzerindeymiş gibi düşecek. Gerçek vücut ağırlığı eksik. Klipteki su bunun için harikadır. Genel olarak yeni nesil yapay zeka video oluşturucularının, geçmişte çok daha kötü görünen bu şelale de dahil olmak üzere suyu çok iyi idare ettiğini fark ettim.
Duyurudan sonra devamını okuyun
Ateşle durum farklıdır. Yanan elektrikli scooter'a baktığınızda şunu fark ediyorsunuz: AI ateşi yanmıyor, daha çok parlayan bir plazma gibi akıyor. Ve gerçek ateş çevrenize sert, titreşen gölgeler düşürür. Bu, yapay zekada neredeyse her zaman eksiktir çünkü mevcut oyunların aksine, ışık davranışını, yani ışın izleme anahtar kelimesini simüle etmez. Garip bir şekilde, aynı fizik bizi gerçek bir anda durdurdu. Sepp Blatter'in banknotlara çarptığı video o kadar absürt görünüyordu ki, ilk başta bunun bir yapay zeka olduğu düşünülebilirdi. Ancak yapay zeka şu anda her banknotun ayrı ayrı nasıl döndüğünü ve ışık yakaladığını idare edemiyor. Yani bazen mükemmel fizik onun gerçek olduğunun kanıtıdır.
Tıpkı nesnelerle etkileşimin genellikle iyi bir gösterge olduğu gibi, örneğin kırpma sorunu. İki katı malzeme birbirine temas ettiği anda yapay zeka genellikle aralarındaki sınırı kaybeder. Gerçek Söder'in sosisli sandviçi ısırmasını ve ardından AI Söder'in bira şişesinden içmesini sağladık. Şişeyle dudaklarınız arasındaki etkileşime de dikkat edin. Karşılaştırıldığında dudaklarım ve şişe gerçek bir videoda. Artık çok büyük bir fark yok. Ancak burada bisikletçinin cama vurmasıyla durum daha da netleşiyor. Aslında cilt düzleştirilmelidir. O yapmıyor. Parmaklar yuvarlak kalır ve direnç göstermeden kayar.
Çünkü anatomi ve hareket çoğu zaman hala zordur. Elbette, yapay zeka destekli videolarda bile insanların ellerinde artık güvenilir bir şekilde beş parmak var ve modeller artık bireysel yüzleri neredeyse mükemmel bir şekilde yeniden üretebiliyor. Ancak hareket veya derinlik devreye girdiğinde bozulur. Kalabalığın arka planına bakın. Fan Mile videomuzda ön taraftaki insanlar güzel görünüyor ancak arka tarafta gerçek bir et dağına dönüşüyorlar. Kollar yanlış vücutta, yüzler sadece ten renginde lekeler ve özellikle hızlı hareket ederken hatalar olmaya devam ediyor. Bu klipte koşan Golden Retriever, klasik gölgelenme sergiliyor, yani pençeleri asfaltın biraz üzerinde asılı duruyor ve yapay zeka, hareket bulanıklığını yanlış şekilde enterpolasyona aldığı için doğal olmayan hareketler sergiliyor. Genel tavsiye: Yürürken ayaklarınıza dikkat edin. Çoğu zaman ayak tabanları sanki kişi kayıyormuş gibi zemin üzerinde kayar.
Ve videolardaki yazılara dikkat edin. Beynimiz harfleri tanımakta çok iyidir ve yapay zeka tam da bu noktada bir şey hareket ettiğinde başarısız olur. En iyi örnek araç kamerası videomuzdu. Plaka sabit olduğu sürece sorun yok, ancak hareket olur olmaz karakterler okunamayan uzaylı hiyerogliflerine dönüşüyor. Buna zamansal titreme denir. Aynı şey zincir bağlantı veya damalı çitlerde de olur. Ve mantıksız asimetrilere dikkat edin: hiçlikle sonuçlanan gözlük sapları veya solda düğmeleri ve sağda fermuarı olan bir ceket.
Beşinci nokta: optik. Ve bizi gerçekten kandırdı. İnce dokuların arka planda sallanmaya başlayıp başlamadığını görün. Buna kaynama denir çünkü görüntü hafifçe kaynıyor gibi görünür. Madeira kayalıklarının üzerinde insansız hava aracıyla uçuş yaptık ve ben ancak haziran başında oradaydım. Aslında uçurumdaki yeşil o kadar da tuhaf bir şekilde titreşmiyor. Ancak yapay zeka, kafasında ortamın sabit bir 3 boyutlu haritasına sahip olmadığı için her karede her yaprağı ayrı ayrı yeniden icat etmek zorunda kaldı. Karşılaştırma için, Kanada'daki bir sıra ev yerleşimi üzerinde bir dronun gerçek uçuşu: çatılar, çizgiler ve çitler kesinlikle katı kalıyor.
Ve şimdi en önemli kısım, bir noktada pikseller mükemmel olsa bile sizi kurtaracak. Sağduyu. Bu kadar viral kliplerin en önemli kanıtı: neden burada çekiliyorlar? Eli sağlam olan biri neden üç saniye sonra bir gök taşının çarptığı ıssız bir köy yolunu filme alsın ki? Kamera önceden çok mükemmelse, insanın tepki süresi eksik olur. Ve sonra tabii ki mantığa dikkat edin. Böylece e-scooter ile bir ateş topu patlıyor ve yayalar huzur içinde yürümeye devam ediyor. Evet, yapay zeka nedenselliği anlamıyor. Videoda gerçekten kötü bir şey görürseniz tekrar kontrol edin. O halde başka perspektifler, başka çekimler arayın. Bir ekran görüntüsü alın ve bunu Google görsel aramaya girin. Çünkü eğer gerçekten olduysa, her zaman az önce izlediğiniz videodan daha fazlası vardır. Ayrıca sese de dikkat edin. Birçok AI videosu sessiz olarak oluşturulur veya oldukça fark edilebilir bir AI sesine sahiptir.
İşte kontrol listeniz: fizik, kırpma, anatomi, yazı yazma ve sağduyu. Artık tüm bunları bildiğinize göre 15 klibimizin tamamını doğru tahmin etmiş olursunuz, değil mi? Üç değerlendiricimiz de her videoda haklı değildi. Chris'in iki kusuru vardı ve Şahin ile Keno'nun üç kusuru vardı. O Chris DeBolle'du. Kuyu! Bunu kabul etmiyorum. Teşekkür ederim teşekkür ederim. Kabul ediyorum. Tebrikler. Teşekkür ederim. Keno'nun kazanamadığı için mutluyum. Evet, ben de. Ne? Evet, rahatsız edici.
Yani bir yıl daha. EVET. O zaman bir sorunumuz var. Bence zaten bir sorunumuz var çünkü normal insanların bu nispeten bariz ipuçlarını fark etme olasılıkları çok daha düşük. Ben de sosyal medyada yapay zeka tarafından oluşturulan bir videonun gerçek olduğuna inandım. Her neyse. Bu benim de başıma geldi, bu yüzden burada güvenlik kamerası görüntülerinin olmamasına şaşırdım. Ya da öyle… araç kamerası. Evet, araç kameraları. Orada çok kaliteli bir araç kamerası vardı. Ama tam olarak gözetleme deliği ve bu Fitton Hole kamerası. Ring, bu Ring kamera. Aynen, birkaç kez buna aşık oldum. Ve sonra birdenbire her şey şöyle başlıyor… İlk başta bunun gerçek olduğunu düşünüyorum, sonra birdenbire bir kedi bir şekilde, ne bileyim, bir mariachi grubu gibi davranmaya başlıyor. Ayrıca kız arkadaşıma bunun gibi hayvan videoları göndermeyi seviyorum ve o da “Hey, böyle anlarsın” diyor. Trambolin üzerindeki bu üç tavşanı gördün mü? Hayır. Ama bu bir türdü. Önce bir kanguru falan vardı, sonra… Ama kitlelerin gerçekten aşık olduğu ilk şey buydu. Bu şekilde bir izlenim edindim. Yani yapay zekanın oluşturduğu görüntülerle birlikte Papa'nın bu görüntüsü vardı… Evet, bu bir eğim değildi. Ve videolarda trambolinde bu hayvan vardı. Ayrıca Sam Altman'ın hırsızlık yaparken yakalandığını da düşündüm. Bu beni gerçekten neşelendirdi çünkü ben de bunu istiyordum. Deepfake olan bu politik içeriğin sorunu da bu. Eğer insanların inanmak istediği buysa, o zaman eğilimin daha da yüksek olduğu açıktır. Evet ama şimdi ne yapabiliriz? Podcast'te bunun hakkında daha fazla konuşacağız. Bekleyemiyor musun?
Yapay zeka testimizin tamamı bu kadar. Bir sonraki 4004 podcast'inde Chris ve Keno, az önce burada yaptığımız bu yapay zeka deneyi hakkında daha ayrıntılı konuşuyorlar. Dinlediğinizden emin olun. Aksi takdirde, bu testte ne kadar başarılı olduğunuzu yorumlarda bize bildirin. Her şeyi tanıyabildiniz mi ya da yapay zekaya nereden aşık oldunuz? Ve elbette kayıt olmaktan ve bültenimize danışmaktan çekinmeyin. Bir dahaki sefere görüşürüz. MERHABA!
c't 3003, c't'in YouTube kanalıdır. C't 3003'teki videolar bağımsız içeriktir ve c't dergisi makalelerinden bağımsızdır. Editörler Jan-Keno Janssen, Lukas Rumpler, Şahin Erengil ve Pascal Schewe her hafta bir video yayınlıyor.
(ROM)

Bir yanıt yazın