- Yapay zeka şirketleri, toplu satın aldıkları nadir kitapların sırtlarını kesip yüksek hızlı taramadan geçirdikten sonra orijinallerini parçalıyor
- ISBNdb, 1 milyon kitaba kadar siparişleri, alıcı anonimliği ve NDA desteği sunuyor; müşterilerine bu süreci “dijital koruma” olarak adlandırmalarını öneriyor
- 2022 öncesi yayınlar, yapay zeka tarafından üretilmiş metinle karışmamış veri olduğu gerekçesiyle yüksek değer görüyor; Anthropic de geniş kapsamlı kitap temini için girişimlerde bulunuyor
- Federal bir yargıç, orijinali ortadan kaldırıp bir seferde yalnızca tek bir kopya bırakma yöntemini adil kullanım olarak değerlendirdi; ancak hayatta kalan nüsha sayısı son derece az olan kitaplar da işleme dahil ediliyor
- Günümüze ulaşan bir 18. yüzyıl kitabının son kopyası parçalandıktan sonra yerine konamaz; yasal karar, geri döndürülemez tahribatı hızlandırabilir
Nadir kitapların eğitim verisine dönüşme süreci
- Yapay zeka şirketleri kitapları toplu halde satın aldıktan sonra sırtlarını kesip yüksek hızlı tarama yapıyor ve orijinalleri parçalıyor
- ISBNdb, 1 milyon kitaba kadar siparişe aracılık ederken alıcının kimliğini gizliyor
- NDA’yı bir hizmet özelliği olarak sunuyor
- Müşterilerine bu işlemi “dijital koruma” diye adlandırmalarını öneriyor
- Kendi web sitesinde, “‘Yapay zeka şirketi 2 milyon kitabı yok ediyor’ ifadesi sempati toplayacak bir başlık değildir” diyor
- 2022 öncesi yayınlar, yapay zeka tarafından üretilmiş metin içermedikleri gerekçesiyle premium veri olarak değerlendiriliyor
- Anthropic, “dünyadaki tüm kitapları” elde etmek için eski Google Books iş ortaklıkları yöneticisini işe aldı
Adil kullanım kararının bıraktığı geri döndürülemezlik
- Federal bir yargıç, orijinal ortadan kaldırılırsa belirli bir anda yalnızca tek bir kopya var olur mantığıyla bu uygulamayı adil kullanım olarak değerlendirdi
- Bir kitapçı yetkilisi, geriye çok az nüshası kalmış nadir kitapların da işleme alındığını 404 Media’ya aktardı
- Web siteleri yeniden yayına alınabilir, çok satan kitaplar yeniden basılabilir; ancak geriye yalnızca son üç kopyası kalmış bir 18. yüzyıl botanik kitabı, parçalandıktan sonra yerine konamaz
- İnternet scraping’i, kütüphane torrent’leri ve müziğin izinsiz elde edilmesinden farklı olarak orijinalin parçalanması geri döndürülemez; yasal kararın ardından bu tür işler hız kazanabilir
1 yorum
Hacker News yorumları
Yayıncılara pek sempati duymuyorum. Telif hakkı süresi dolana kadar kitapları baskısı tükenmiş halde tutup sapasağlam kitapları nadir nüshaya dönüştürüyorlar; satışta olan kitaplarda bile çoğu zaman nemde dalgalanan kâğıt ve birkaç yıl içinde sayfaları dağılan yapıştırma cilt dışında seçenek olmuyor.
Yayıncının baskıdan kaldırdığı kitaplar, başka bir yayıncı tarafından ilk yayıncıya ödeme yapılmadan yayımlanabilmeli; yazarla telif ücreti yeniden müzakere edilebilmeli. Dayanıklı kâğıt ve forma dikişli cilt kullanan ciltli baskı sunulmadığında da başka yayıncıların kaliteli baskı yapabilmesi için telif yasası değişmeli.
Küçük yayıncıların hukuki mücadele verecek gücü de yok. Söz konusu kanal: https://www.youtube.com/@diggingthegreats/videos
O dönemde kitaplar çoğu kişinin alamayacağı lüks ürünlerdi; ucuz seri üretim ciltler yaygınlaşınca erişilebilirlik arttı. Bugün de piyasadaki kitapları söküp yüksek kaliteli özel cilt ve kapak yapan zanaatkârların bulunduğu bir pazar var.
Yayıncıların gizli bir kaliteli baskı talebini bilerek görmezden geldiğini varsaymaktansa, satış verilerinden bunun satmayacağını bildiklerini düşünmek daha basit. Amaç korumaysa, biraz daha iyi kâğıdı zorunlu kılmak yerine stok depoları veya koleksiyoner rafları dışında sağlam bir dijital arşiv kurulmalı.
Telif durumunu kontrol ettikten sonra eski kitapları yeniden basıyoruz. Tüm kitaplar 1930 öncesi yayımlanmış baskılardan seçiliyor; hak sahibinin yenileme yapıp yapmamasına bağlı olarak önemli bir kısmında 1964 ya da 1973'e kadarki kitaplar da mümkün.
Özel bir kesme makinesiyle sırtı kesiyor, ardından tek tek sayfaları mühürlü plastik kılıflara koyup kalıcı olarak saklıyoruz; yeniden taramaya karşı, sıkıştırılmamış özgün dosyaları da manyetik disklerde koruyoruz. Telif süresi biter bitmez yayımlayabilmek için 1931 sonrası nadir baskıları da önceden arıyoruz; ancak hiçbir yapay zeka şirketi tüm taramaları eğitimde kullanmak için izin istemedi.
Eski metinlerin kendisi ilginç ve korunmaya çok değer, ancak dev eğitim verisine karıştırmak için daha az kullanışlıdır.
Tarananlar yalnızca telifi devam eden kitaplarsa, 18. yüzyıl botanik kitaplarının neden dahil edildiğini merak ediyorum. Sahip olunan bir kitabı taramak telif açısından yasal olmalı ve bunun için imha şart koşulmamalı.
Yayımlanmasının üzerinden 50 yıldan fazla geçmiş ve unutulma riski taşıyan eserlerde yetim eser düzenlemesi uygulanarak, hak sahibinin eserin birkaç kütüphane vb. yerde korunduğunu kanıtlaması, ek kopyalara izin vermesi ya da teliften vazgeçmesi sağlanabilir.
OpenAI'ın Amazon'dan 2018 tarihli bir kitabın dijital baskısını satın alıp doğrudan kullanamamasının nedeni, lisans ihlaline ek olarak DRM kaldırmayı yasaklayan DMCA'ya da takılmasıdır.
Archive.org, elindeki fiziksel kitapları ödünç verdiği için dava edilmemiş olsaydı, böyle bir sonuç da önlenebilirdi. Yayıncıların istedikleri sonucun ne olacağını daha dikkatli düşünmesi gerekirdi.
Yayıncılar, gölge kütüphane verileriyle eğitim yapan AI şirketlerine dava açıp büyük içerik anlaşmaları koparmayı hedefledi; ancak AI şirketleri analog açığı kullandı. İkinci el kitabı 5 dolara alıp imhalı taramaya 25 dolar harcamak, telif ücretinden çok daha ucuz.
Ancak söz konusu olan kadim metinler değil, telifi devam eden kitaplar; ayrıca eski olması da değerli olduğu anlamına gelmez. Talep görmeyen ve yalnızca depolama maliyeti çıkaran kitapları kütüphaneler elden çıkardığı için tarama şirketleri bunları ucuza bulabiliyor.
Bradbury’nin 《Fahrenheit 451》’inden çok Vernor Vinge’in 《Rainbows End》’indeki “parçala ve tara” fabrikasına benziyor
Nadir kitapları dijitalleştirirken Authors Guild v. Google’ın yol açtığı zararı da geri çevirmek mümkün. Yapay zeka şirketlerinin tarama yapmasına izin verilip dijital kopyaları yayımlamaları zorunlu kılınabilir; ilk tarayan şirketin avantajı için de birkaç yıllık bir bekleme süresi tanınabilir: https://en.wikipedia.org/wiki/Authors_Guild,_Inc._v._Google,...
Buna karşılık, kitabı yüksek kalitede dijitalleştirip kalıcı olarak ücretsiz erişime açmak; kütüphanelerde ve çevrimiçi olarak ücretsiz kullanılabilecek kamusal bir LLM üzerinden erişilebilir kılmak; geriye fiziksel nüsha kalmadıysa yeterli doğrulamadan sonra kamusal bir nadir eser arşivinde korunmasını düzenlemek çok daha makul olur
Aptalca telif hakkı yasaları yüzünden yapay zeka şirketlerinin seçebileceği yasal yol buysa, tüm suçu onlara yüklemek zor. Yerel gölge kütüphaneyi destekleyebilirsiniz: https://annas-archive.pk/donate
Yalnızca alıntılanan materyallere bakınca nadir kitapların gerçekten yok edildiğine dair kanıt yetersiz. Yeri doldurulamaz 18. yüzyıl botanik kitapları örnek olarak eklenmiş, ancak gerçek hedeflerin satışta olan ya da yaygın kitaplar olma ihtimali dışlanamıyor
Buradaki nadir kitaplar, tarihsel açıdan önemli Orta Çağ el yazmaları değil; telif hakkı hâlâ süren ama piyasadaki fiziksel nüshası az olan nispeten yakın tarihli kitaplar gibi görünüyor. Böyle bir kitabın bir nüshasını yok ederek içeriğini dijital olarak korumak mutlaka kötü sayılmayabilir; telif hakkı süren kitapların değeri de çoğunlukla fiziksel taşıyıcıdan ziyade içeriktedir