Haberler

Yapay Zekâ Şirketlerinin Kitap İmha Operasyonları Rekabet Tartışmasını Başlattı

ABD’de 18 sivil toplum kuruluşu, yapay zekâ şirketlerinin model eğitimi için satın aldığı fiziksel kitapları taradıktan sonra imha etmesini rekabet açısından incelemesi için Federal Trade Commission’a (FTC) başvurdu. Uygulamanın Anthropic tarafından “Project Panama” adıyla yürütüldüğünü gösteren belgeler, kitapların dijitalleştirildikten sonra fiziksel kopyalarının ortadan kaldırıldığını ortaya koyarken Amazon’un da benzer bir sürece dahil olduğu iddia edildi. Gruplar, nadirleşen kitapların topluca yok edilmesinin yapay zekâ şirketlerinin bilgi kaynakları üzerindeki kontrolünü artırabileceğini savunuyor.

Project Panama Belgeleri Kitapların Taranıp İmha Edildiğini Gösterdi

Bartz v. Anthropic PBC davasında ortaya çıkan şirket içi belgeler, Anthropic’in kitap tarama operasyonunun 2024 yılında “Project Panama” kod adıyla yürütüldüğünü gösterdi. Şirket içi bir belgede operasyonun dünya genelindeki kitapların büyük bölümünü fiziksel olarak tarayıp imha etme hedefiyle ilişkilendirildiği görülürken çalışanlardan çalışmanın şirket dışında paylaşılmaması istendi.

Anthropic’in bu yöntemi tercih etmesinin arkasında iki teknik gerekçe bulunuyor. Eski kitaplar, yapay zekâ tarafından üretilmiş metinlerle daha az kirlenmiş veri kaynakları olarak model eğitimi açısından değer taşırken fiziksel kopyaların tarama sonrasında saklanmaması depolama maliyetlerini azaltıyor. Kitabın dijital kopyasının elde tutulması ise şirketin eğitim verisi hazırlama sürecinde fiziksel arşiv yönetimi ihtiyacını ortadan kaldırıyor.

Bartz davasında bir federal bölge mahkemesi, fiziksel bir kitabın dijitalleştirildikten sonra imha edilmesinin belirli koşullarda dönüştürücü kullanım kapsamında değerlendirilebileceği yönündeki yaklaşımı kabul etti. Mahkemenin değerlendirmesi, fiziksel kopyanın yerine dijital kopyanın geçirilmesini telif hakkı analizinin önemli unsurlarından biri olarak ele aldı.

Internet Archive ise benzer bir hukuki zeminden aynı sonucu elde edemedi. Kurumun kitapları dijitalleştirerek çevrim içi erişime açmasına ilişkin telif davası, yapay zekâ şirketlerinin kendi modellerini eğitmek için veri edinmesiyle birebir aynı hukuki tabloyu oluşturmuyor. ABD telif hukukunda adil kullanım değerlendirmesi, eserin niteliği, kullanım amacı, kullanılan bölümün kapsamı ile orijinal eserin pazarı üzerindeki etki gibi birden fazla faktöre göre yapıldığı için her tarama ve çoğaltma işlemi aynı sonucu doğurmuyor.

Amazon hakkında yayımlanan yakın tarihli bir rapor, şirketin de kitapların yapay zekâ sistemlerinde kullanılmak üzere taranıp parçalanmasına yönelik faaliyetlerde bulunduğunu öne sürdü. Amazon iddialar hakkında yorum yapmazken şirketin uygulamadaki rolünün kapsamı kamuya açık bilgilerle henüz tam olarak ortaya konulmuş değil.

ISBNdb gibi kitap tedarik sürecinde aracılık ettiği bildirilen şirketler de tartışmanın ardından geri adım attı. ISBNdb, yapay zekâ büyük dil modeli veri kümeleri için basılı kitap tedarikine yönelik bir internet sayfasını kaldırdığını açıklarken söz konusu çalışmanın yalnızca pazar talebini değerlendirme amacı taşıdığını belirtti.

18 kuruluşun FTC’ye yaptığı başvurunun temelinde kitapların yok edilmesinin yalnızca telif hakkı sorunu olmadığı iddiası bulunuyor. Gruplar, şirketlerin satın aldıkları kitapları fiziksel olarak ortadan kaldırmasının rakip yapay zekâ geliştiricilerinin aynı kaynaklara erişmesini engelleyebileceğini savunuyor.

Demand Progress Education Fund özel danışmanı Kate Oh, büyük yapay zekâ şirketlerinin kitapları gizli biçimde satın alıp imha etmesinin FTC tarafından araştırılması gereken rekabet sorunlarına işaret ettiğini söyledi. Başvuruyu yapan kuruluşlar, FTC’nin rekabet otoritesi olarak yapay zekâ şirketlerinin bilgi kaynaklarını toplamasının pazardaki giriş engellerini artırıp artırmadığını incelemesini istiyor.

Kitapların fiziksel kopyalarının yok edilmesiyle ilgili en önemli belirsizlik, imha edilen eserlerin başka nüshalarının bulunup bulunmadığı noktasında ortaya çıkıyor. FTC’ye gönderilen mektupta kuruluşlar, kamuya açık kayıtların hangi kitapların dünyadaki son veya son birkaç fiziksel kopyası olduğunu belirlemeye yetmediğini savunuyor.

Kütüphaneler, arşivler, üniversiteler ile özel koleksiyonlar açısından fiziksel kitabın değeri yalnızca içerdiği metinden oluşmuyor. Baskı bilgileri, kâğıt yapısı, yayınevi özellikleri, dipnotlar, ekler ile eserin maddi biçimi de kültürel miras açısından ayrı bir kayıt oluşturabiliyor. Bir kitabın yapay zekâ modeline aktarılmış olması da o eserin eksiksiz ve doğrulanabilir biçimde gelecekte yeniden üretilebileceği anlamına gelmediği için fiziksel kopyanın kaybı bağımsız bir bilgi kaybı yaratabiliyor.

Yapay zekâ şirketlerinin eğitim verisi edinme yöntemleri, modellerin teknik performansından daha geniş bir rekabet tartışmasına doğru ilerliyor. Yüksek kaliteli kitap koleksiyonlarının satın alınarak rakiplerden uzaklaştırılması gerçekten yaygın bir uygulamaysa şirketlerin yalnızca hesaplama gücü veya model mimarisi üzerinden değil veri erişimi üzerinden de avantaj sağlaması söz konusu olabilir.

FTC’nin başvuruyu nasıl değerlendireceği henüz belli değil ancak tartışmanın merkezindeki soru giderek daha belirgin hale geliyor: Bir şirket bir kitabın fiziksel kopyasını satın aldıktan sonra onu imha edebilir mi, yoksa eserin nadirliği ve kamu yararı satın alma hakkının ötesinde bir değerlendirme gerektirir mi? Özellikle yapay zekâ eğitim verilerinin çoğu şirket tarafından açıklanmaması, imha edilen eserlerin hangi modellerde kullanıldığının bağımsız biçimde doğrulanmasını da zorlaştırıyor.

İlgili Makaleler

Bir yanıt yazın

Başa dön tuşu