New York Times’ın OpenAI ve Microsoft’a karşı üç yıl önce açtığı telif davasında kamuya açılan yeni belgeler, şirketlerin yapay zekâ eğitimi için içerik toplama yöntemleri ve bunun yayıncılara etkisine dair iç değerlendirmeleri ortaya koydu. Belgelerin önemli bölümü The Times’ın dilekçesine dayanırken, dayanak ekler hâlâ gizli tutuluyor.
Dilekçeye göre Microsoft’un Uygulamalı Bilimler Direktörü Brent Hecht, Ocak 2023’te yapay zekâ için veri toplama uygulamalarını “benzeri görülmemiş boyutta şaşırtıcı bir emek hırsızlığı” ve “insanlık tarihindeki en büyük emek hırsızlığı” olarak niteledi. OpenAI’nin ChatGPT’den sorumlu yöneticisi Nick Turley ise sohbet botları gibi ürünlerin yayıncılar açısından “varoluşsal tehdit” oluşturduğunu, ürünlerin büyük ölçüde ikame edici olduğunu ve geliştikçe daha da ikame edici hale geleceğini yazdı.
Microsoft verileri, Copilot’un “answer engine” özelliğinin The New York Times alan adına yönlenen tıklama oranlarını geleneksel Bing aramasına kıyasla yüzde 93’e kadar düşürdüğünü gösterdi. Hecht’in Ocak 2024 tarihli sunumunda bu durum, hem modellerin performansını hem de interneti aynı anda zedeleyebilecek bir “doom loop” olarak tanımlandı. Satya Nadella da bu yılki ifadesinde, ödeme duvarı arkasındaki içeriklerin eğitim veya grounding için kullanılacaksa lisanslanması gerektiğini söyledi.
Belgelerde OpenAI’nin ara eğitim veri setlerinde NYT, Daily News ve Center for Investigative Reporting’in yayımladığı eserlerin 91,692’den fazla kopyasının bulunduğu belirtiliyor. Common Crawl kaynaklı bir veri setinde yalnızca nytimes.com’dan 2 milyondan fazla belge yer aldı. Project Mango kapsamında oluşturulan veri setinin ise haber yayıncılarına ait en az 160,903 benzersiz eserin kopyalarını içerdiği iddia edildi.
Dava dosyası, şirketlerin Bing Index üzerinden içerik topladığını, OpenAI çalışanlarının ödeme duvarlarını fark edilmeden aşma planları geliştirdiğini ve telif bildirimlerinin model çıktılarında görünmemesi için eğitim verilerinden çıkarıldığını öne sürdü. OpenAI ve Microsoft yorum taleplerine yanıt vermedi.
Neden önemli
Belgeler, davanın yalnızca telifli materyallerin izinsiz kullanılıp kullanılmadığıyla sınırlı olmadığını; yapay zekâ ürünlerinin yayıncıların okur trafiği ve gelir modeli üzerindeki etkisinin de uyuşmazlığın merkezinde yer aldığını gösteriyor. Özellikle arama sonuçları yerine doğrudan yanıt sunan sistemlerin, kullanıcıyı haber sitesine yönlendirme ihtiyacını azaltabileceği yönündeki şirket içi değerlendirmeler, yayıncıların lisanslama taleplerinin ekonomik gerekçesini güçlendirebilir. Bununla birlikte dosyadaki birçok iddia, New York Times’ın dilekçesinde aktarılıyor ve dayanak eklerin gizli olması, verilerin kapsamı ile toplama yöntemlerinin bağımsız biçimde incelenmesini şimdilik sınırlıyor. Şirketlerin yorum yapmaması da bu aşamada anlatının büyük ölçüde dava taraflarından birinin sunduğu belgelere dayanması anlamına geliyor.
Arka plan
Microsoft, FikirPilot arşivinde yeni bir ad değil: son 90 günde bu adın geçtiği 15 haber yayımladık; en yenisi 19 Eylül 2026 tarihli.