Yapay zeka şirketleri, eğitim verisi elde etmek için 2022 öncesi basılmış milyonlarca kitabı dijitalleştirme sürecinde yok ediyor.
Yapay zeka şirketleri, lisan modellerini eğitmek emeliyle 2022 öncesinde basılmış kitapları yoğun bir formda kullanmaya başladı. Bu kitapların tercih edilmesinin temel sebebi, yapay zeka tarafından üretilen içeriklerden arındırılmış olmalarıdır.
Veri komitecisi ISBNdb, insan tarafından yazılmış ve yapay zeka çıktısı içermeyen metinlere ulaşmak isteyen geliştiricilere toplu halde kitap sağlıyor. Bu süreçte kitapların dijitalleştirilmesi için uygulanan yollar ise büyük bir tartışma konusu haline geldi.
Kitapların imhası ve dijitalleştirme süreci
Dijitalleştirme süreci sırasında kitapların sırt kısımları kesilerek sayfalar birbirinden ayrılıyor ve bu süreç özgün fizikî kopyaların büsbütün yok olmasına sebep oluyor. Süratli tarama ekipmanları kullanılarak gerçekleştirilen bu sistem, kitapların fizikî bütünlüğünü koruyan yavaş yollara kıyasla maliyet açısından daha avantajlı görülüyor.
ISBNdb, bu süreci dijital müdafaa olarak adlandırsa da eleştirmenler durumun kültürel bir kayba yol açtığını belirtiyor. Şirket, müşterilerinin kimliklerini kapalı tutmak için sıkı saklılık kontratları uyguluyor ve bu ticari faaliyetler hakkındaki yansıları yönetmeye çalışıyor.
Uzmanlar, bu tarama süreçlerine giren kimi yapıtların savaşlar ve yangınlar üzere şiddetli süreçlerden geçerek günümüze ulaşmış ender kopyalar olduğunu vurguluyor. İnternet içeriklerinin bilakis, bu fizikî eserler yok edildiklerinde bir daha geri getirilemiyor.
ABD’de Anthropic ile ilgili yakın tarihli bir mahkeme kararı, yasal olarak satın alınan kitapların yapay zeka eğitimi için taranmasını makul şartlar altında adil kullanım olarak kıymetlendirdi. Kararın münasebetinde, tarama sırasında fizikî kopyanın yok edilmesinin, yeni kopyalar oluşturmak yerine mevcut yasal kopyanın yerini aldığı savunuldu.
Kültürel miras ve geleceğe dair endişeler
Elon Musk, bu tekniğe yönelik reaksiyonlara cevaben SpaceXAI takımına az kitapları kütüphanelerde müdafaalarını ve daha yavaş fakat inançlı prosedürlerle taramalarını söylediğini belirtti. Bu yaklaşım, süratli imha usulüne karşı alternatif bir model oluşturma eforu olarak görülüyor.
Yapay zeka modellerinin kalitesini korumak için başvurulan bu sistem, model çöküşü olarak bilinen ve sistemlerin kendi ürettikleri içeriklerle eğitilmesi sonucu oluşan kalite kaybını engellemeyi amaçlıyor. Ayrıyeten bu süreç, muharrirlerin yapay zeka eğitimini engellemek için kullandığı data zehirleme tekniklerinden de kaçınmayı sağlıyor.
Ancak bu sessiz imha süreci, kültürel mirasın korunması konusunda önemli soru işaretleri yaratmaya devam ediyor. Az yapıtların dijital bilgi setlerine dönüştürülürken fizikî olarak yok edilmesi, gelecekte telafisi imkansız bir kültürel boşluk oluşturma riski taşıyor.
Sizce az yapıtların dijitalleştirilmesi uğruna fizikî kopyalarının yok edilmesi kabul edilebilir bir durum mu?
Kaynak: Shiftdelete