Üç yayıncı, romancı Scott Turow ve şirketi SCRIBE, Google'ı Gemini'yi eğitmek için milyonlarca kitap ve dergi makalesini kopyalamakla suçlayan toplu dava teklifinde bulundu. Buna Google Kitaplar, Play Kitaplar ve Akademik aracılığıyla sağlanan çalışmalar da dahildir.
10 Temmuz'da Hachette Book Group, Cengage Learning, Elsevier, Turow ve SCRIBE, ABD New York Güney Bölgesi Bölge Mahkemesinde açılan bir davada bir araya geldi ve Amerikan Yayıncılar Birliği bunu aynı gün duyurdu. Bu hizmetlere sağlanan kitap ve makalelerin belirli amaçlara yönelik olduğunu ve bunları ticari bir yapay zeka modelini eğitmek için kullanmanın bunlardan biri olmadığını savunuyorlar. Davada ayrıca Google'ın, korsan siteler ve ödeme duvarlı kütüphaneler de dahil olmak üzere web sitelerinden elde ettiği çalışmaları kopyaladığı iddia ediliyor. Google, yayınlanma tarihi itibarıyla şikayet hakkında herhangi bir yorumda bulunmadı ve hiçbir mahkeme iddiaların herhangi biri hakkında karar vermedi. Asıl soru, tek kullanım izninin aynı zamanda o veriler üzerinde bir model eğitilmesini de kapsayıp kapsamadığıdır.
Şikayette İddia Edilenler
Şikayet dört sayıyı beraberinde getiriyor. Üçü, Google Kitaplar ve diğer Google hizmetlerini, web kazıma indirmelerini ve eğitim sırasında kopyalamayı kapsayan Telif Hakkı Yasası kapsamında izinsiz çoğaltma yapıldığını iddia ediyor. Dördüncüsü, Google'ın DMCA'yı ihlal ederek telif hakkı yönetimi bilgilerini kaldırdığını iddia ediyor. Davacılar tazminat, ihtiyati tedbir, Gemini'nin eğitim için kullandığı eserlerin ayrıntılı bir açıklamasını ve izinsiz kopyaların silinmesi için mahkeme emri talep ediyor. Dosyalamada dahili Google belgeleri olarak tanımlanan belgelerden alıntı yapılıyor; bunlardan biri, Google Play Kitaplar'daki kitapların AI için kullanılmasını “Google için son derece sorunlu” olarak nitelendiriyor ve “10 Milyar Dolar ile 100 Milyar Dolar arasında potansiyel para cezaları” içeriyor. Gemini'nin baş mühendisinin meslektaşlarına “zaten sahip olduğumuz veya zaten sahip olduğumuz veriler için anlaşma yapmıyoruz” dediğini söyleyen başka bir söz daha var. Bu belgelerin hiçbiri kamuya açık değildir ve alıntılar davacıların dosyalarından alınmıştır.
Paletli Kontrollerin Durduğu Yer
Google Genişletilmiş, Google'ın sitenizde taradığı içeriği kapsayan robots.txt belirtecidir. Bu içeriğin gelecekteki Gemini eğitimi ve bazı temel kullanımlar için kullanılıp kullanılamayacağını kısıtlar. Burada tartışılan iki kaynak bulma yönteminden hiçbiri bu tokenı içermiyor. Kitaplar sözleşmeler yoluyla doğrudan Google'a sağlanmıştır, dolayısıyla robots.txt dosyası bu süreci etkilemez. Web kazıma iddiaları, şikayete göre korsan sitelerde ve abonelik kitaplıklarında barındırıldıktan sonra Common Crawl'da görünen kopyalara atıfta bulunuyor. Bu kopyalar farklı etki alanlarında barındırıldığından robots.txt dosyası bunları düzenleyemez.
25 Haziran'da Google, herkese açık web verileriyle ilgili eğitimin, adil kullanım korumaları kapsamında “dönüştürücü, ifade edici olmayan bir kullanım” olduğunu savunan bir politika belgesi yayınladı. Makalede ayrıca web sitelerinin devre dışı bırakmak için kullanabileceği Google-Extulated gibi makine tarafından okunabilen kontrollerden de bahsediliyor. Ancak burada incelenen malzemenin farklı kanallardan geldiği iddia ediliyor.
Geçtiğimiz ay Digital Content Next, Common Crawl Foundation'a, telif hakkı yasasının bir devre dışı bırakma sistemi olarak işlemediğini ileri süren bir durdurma ve vazgeçme mektubu gönderdi.
Bu Neden Önemli?
İzin sorusu ve adil kullanım sorusu ayrı konulardır. Adil kullanım, kullanıma izin veren bir anlaşma olmasa ve şikayet her iki sorunu da çözmese bile geçerli olabilir.
Tarayıcı ayarlarınız bu durumun ima edebileceğinden daha küçük bir faktördür. Ocak ayında BuzzStream verileri, önde gelen haber sitelerinin %79'unun, Google Genişletilmiş kanal adresleri olan en az bir AI eğitim botunu engellediğini gösterdi. Burada analiz edilen iki kopya grubunun, bu ayarların etkilemediği yollardan geldiği iddia ediliyor.
İleriye Bakış
2025 yılında, iki Kuzey Kaliforniya kararı, söz konusu eğitim kullanımlarının önlerindeki kayıtlarda adil olduğunu tespit etti. Antropik mahkeme, korsan merkezi kütüphane kopyalarına ilişkin özet kararı reddederken, Meta yargıcı, kararının bu davacılara ve onların kayıtlarına özel olduğunu vurguladı. Yayıncılar, başlangıçta Kaliforniya'da devam eden Google Üretken Yapay Zeka Telif Hakkı Davasına müdahale etmeyi planladıktan sonra New York'ta dava açtıklarını ve yeni davanın, önerilen sınıfın dışında olduğuna inandıkları iddiaları koruduğunu söyledi. Bir sonraki adım, Google'ın yanıt ya da ret talebi olarak vereceği yanıttır.

Bir yanıt yazın