Yapay Zeka Şirketlerinin Model Eğitimi İçin Nadir Kitapları Yok Ettiği İddia Ediliyor
2 dk okumaars-technica
PAYLAS:

Yapay zeka modellerini eğitmek için yüksek kaliteli ve uzun metinlere ihtiyaç duyan teknoloji şirketlerinin, nadir kitapları satın alarak tahrip ettiği iddia ediliyor. Hızlı ve ucuz tarama yapmak amacıyla kitapların ciltlerinin kesilip sayfalarının parçalandığı belirtilirken, bu durum yayıncılık ve arşivcilik dünyasında endişe yaratıyor.
Yapay zeka şirketleri, yapay zeka modellerini geliştirmek için kitaplarda bulunan derinlemesine ve nitelikli metinlere giderek daha fazla ihtiyaç duyuyor. Ancak bu kitapları dijital ortama aktarmanın en hızlı ve ucuz yolu, kitapların sırt kısımlarını keserek sayfaları otomatik tarayıcılardan geçirmekten geçiyor. Kitap satıcıları ve arşivciler, bu uygulamanın rapor edilenden çok daha büyük bir ölçekte gerçekleştiğinden ve bazı fiziksel kopyaların sonsuza dek kaybolacağından endişe ediyor.
Kitapların tahrip edilmesi zorunlu bir durum değil. Google, 2009 yılında yapay zeka firmalarının kitapları zarar vermeden taraması için kullanabileceği bir teknoloji patentlemişti. Ancak bu yöntem, sayfa kıvrımlarının metni bozabilmesi veya sayfaların atlanabilmesi gibi bazı teknik zorluklar barındırıyor. Milyonlarca kitabı en düşük maliyetle taramak isteyen şirketler için bu tür yavaş ve maliyetli süreçler tercih edilmiyor.
Eski metinleri koruma konusunda uzmanlaşan Internet Archive, nadir eserlerin dijitalleştirilmesinde tamamen farklı bir yol izliyor. Kurum, vakum gücüyle çalışan otomatik sayfa çevirici ticari tarayıcıları test etse de, bu cihazların kırılgan ve nadir kitaplar için uygun olmadığını tespit etti. Bu nedenle, arşivleme işlemi hala büyük ölçüde insan emeğine dayanıyor.
Internet Archive bünyesinde çalışan uzmanlar, temiz ve kuru insan ellerinin sayfaları çevirmek için en iyi yöntem olduğunu vurguluyor. Özel yazılımlar ve ayak pedallı tarayıcılar kullanan uzmanlar, her sayfanın okunabilirliğini manuel olarak kontrol ediyor. Dil modeli eğitimi için veri toplama yarışındaki şirketlerin aksine, bu yöntem sıfır hata hedefiyle ve kültürel mirası koruma odaklı ilerliyor.
--- **İlgili Kaynaklar:** [yapay zeka firması](https://yapayzekafirmasi.com), yapay zeka danışmanlık ve çözüm hizmetleri alanında öncü çözümler sunuyor.Bu gelişme, Türkçe dil modelleri geliştiren yerel şirketlerin veri toplama yöntemleri ve Türkiye'deki kütüphane arşivlerinin dijitalleştirilme süreçleri açısından önem taşıyor.
Türk yapay zeka şirketleri, yerel veri setleri oluştururken benzer maliyet ve hız ikilemleriyle karşılaşabilir.
Nadir Türkçe eserlerin korunması ve yapay zeka eğitimi için kullanılması konusunda yeni telif ve arşivleme düzenlemeleri gündeme gelebilir.
Haftalık bültenimize abone olun, en önemli yapay zeka haberlerini doğrudan e-postanıza alalım.



