Teknoloji

Microsoft yöneticisi, yapay zeka veri kullanımını “emek hırsızlığı” olarak tanımlamıştır.

Haberleri Kaçırma!Teknoblog’u Google Arama’da tercihli kaynağın yap ve En Çok Okunan Haberler’de bizi daha sık gör.

Tercihli Kaynak Ekle

The New York Times’ın OpenAI ve Microsoft’a karşı açtığı telif hakkı davasında yeni olarak açığa çıkan belgeler, yapay zekâ modellerinin eğitimi için içeriklerin nasıl kullanıldığına dair tartışmaları yeniden gündeme getirdi. Mahkemeye sunulan belgelerde, üst düzey Microsoft yöneticilerinin içerik toplama yöntemlerini sert bir dille eleştirdiği ve OpenAI yöneticilerinin, ChatGPT benzeri ürünlerin haber yayıncılarının iş modellerine olumsuz etkileri olabileceğini kabul ettiği iddia ediliyor. Belgelerde bunun yanı sıra, ücretli içeriklere erişim, Bing dizininden veri edinimi ve eğitim verilerinden telif haklarının çıkarılması gibi uygulamalara dair yeni bilgiler de bulunuyor. Ancak, bu verilerin çoğu, doğrudan mahkemeye sunulan belgelerden değil, yalnızca Times’ın sunduğu metinden aktarılıyor.

Davanın merkezinde, telif hakkıyla korunan içeriklerin izin alınmadan yapay zekâ eğitiminde kullanımı konusundaki hukuki kabul edilebilirlik sorusu yer alıyor. OpenAI ve Microsoft, bu kullanımların “fair use” yani adil kullanım ilkesi kapsamında değerlendirilebileceğini savunuyor. Ancak, bu kullanımın niteliğinin yanı sıra, orijinal eserin ekonomik etkisi de değerlendirilmektedir. The Times, dava dosyasında şirket içi yazışmalara atıfta bulunarak, bu ekonomik etki konusunun önemine vurgu yapıyor. Ayrıca, Trump yönetiminin OpenAI’ın lisanssız eğitim verisi kullanımı hakkında kısa süre önce olumlu bir görüş sunduğu bilgisi de yer almakta; ancak bu durum bağımsız olarak doğrulanamıyor.

Microsoft belgeleri yayıncı trafiğindeki düşüşü de gündeme getiriyor

Mahkeme belgelerinde yer alan Microsoft verilerine göre, Copilot’un “yanıt motoru” kullanımının The New York Times alanına yönlendirilen tıklamaları geleneksel Bing aramasına göre bazı durumlarda %93 oranında azalttığı belirtiliyor. Microsoft Uygulamalı Bilimler Direktörü Brent Hecht’in Ocak 2024 tarihli bir sunumda bu durumu “doom loop” olarak tanımladığı ve içerik üreticilerinin zayıflamasının uzun vadedeki olumsuz etkilerini vurguladığı ifade ediliyor. Belgede, bir ürünün kendi içerik tedarikçilerini tehdit etmesinin alışılmadık bir durum olduğuna ve büyük dil modellerinin böyle bir risk taşıdığına dikkat çekiliyor. Microsoft CEO’su Satya Nadella, ödemeli içeriklerin yapay zeka sistemleri arasında kullanılacaksa lisanslanması gerektiğini belirtiyor ve eğer OpenAI’ın bu içerikleri izinsiz kullandığı ortaya çıkarsa, Microsoft’un yeniden eğitim talep etme hakkının doğabileceğini ifade ediyor.

İLGİNİZİ ÇEKEBİLİR

OpenAI’yg ChatGPT’den sorumlu yöneticisi Nick Turley’in, sohbet botlarının haber içeri yerini kısmen alabileceği konusunda yaptığı yorumlar, yayıncıların yaşayabileceği ekonomik risklere dikkat çekiyor. OpenAI Başkanı Greg Brockman, modellerin haber alanında “çok başarılı” olduğunu belirtirken, Nadella da botların içerik kaynaklarına yönlendirme ihtiyacını azaltabileceğini kabul ediyor. The Times, bu ifadeleri yapay zeka ürünlerinin mevcut içerikleri dönüştürmekten öte, belirli senaryolar altında orijinal içeriklerle doğrudan rekabet edebildiği yönündeki tezini desteklemek için kullanıyor. Microsoft’a ait diğer belgelerde ise üretken yapay zekanın temel içerik üreticilerinin istihdamı üzerinde önemli bir tehdit oluşturduğuna dair kaygılar yer alıyor.

Yeni belgelerde dikkat çeken bir diğer başlık, kullanılan veri miktarıyla ilgili. OpenAI’in eğitim aşamalarında kullandığı veri kümelerinde, The New York Times, Daily News ve Center for Investigative Reporting’a ait 91 bin 692’nin üzerinde eserin kopyasının bulunduğu ifade ediliyor. Common Crawl tabanlı bir veri kümesinin yalnızca nytimes.com alanından 2 milyon belgeden fazla içerdiği öne sürülüyor. Brent Hecht’in Ocak 2023 tarihli notlarında bu büyük ölçekli veri kullanımını “benzeri görülmemiş bir hırsızlık” olarak tanımladığı da Times’ın başvurusunda belirtiliyor; ancak bu sözlerin orijinal bağlamını içeren belgeler kamuya açık değil.

Günün Öne Çıkan Fırsatları

Tümünü GörDaralt

Dava, OpenAI ve Microsoft’un yayıncı içeriklerini toplama yöntemleri ve lisanslama, trafik ve gelir paylaşımı konuları hakkında daha fazla detay içeriyor. OpenAI’ın GPT-3 eğitim veri kümesinin tamamını Microsoft’a ilettiği ve Microsoft’un bu verileri kendi ürünlerine nasıl entegre edebileceğini değerlendirdiği ileri sürülüyor. Ayrıca, OpenAI araştırmacılarının ödeme duvarlarını aşmanın yollarını tartıştığı ve OpenAI çalışanlarının, The New York Times’ın ödeme duvarını aşmak için bir yöntem bulduğunu bildirdiği iddia ediliyor.

Belgelerde, OpenAI’nın eğitim kümesi olan WebText ve WebText2’nin taranan haber içeriklerine dayandığı, Common Crawl arşivinden milyonlarca makale toplandığı belirtiliyor. The Times, bazı araştırmacıların kullanıcıların telif hakkı bildirimleri almak istemedikleri için eğitim verilerindeki telif bildirimlerini kaldırmak istediklerini de öne sürüyor. New York Daily News adına davası süren avukatı Steven Lieberman, yeni belgelerin OpenAI ve Microsoft’un uygulamalarının sorunlu olduğunu gösterdiğini savunuyor; ancak ilgili ifadelerin çoğu davacıların sunmuş olduğu hukuki belgelerden geldiği için bu alıntılara dair kapsamlı bağlam eksik kalıyor. Dava, yalnızca geçmişteki içeriklerin model eğitiminde nasıl kullanıldığı ile değil, yapay zeka şirketleri ve haber yayıncıları arasında lisanslama tartışmalarının hangi hukuki çerçevede şekilleneceği açısından da önem taşımaktadır.

Teknoblog artık WhatsApp’taGünün en iyi teknoloji fırsatları ve kaçırmamanız gereken büyük haberler, telefonunuza gelsin.

Kanala Katıl

Bir yanıt yazın