Teknoloji

Claude’un Anthropic içindeki rolü beklenenden daha önemli hale geldi.

Haberleri Kaçırma!Teknoblog’u Google Arama’da tercihli kaynağın yap ve En Çok Okunan Haberler’de bizi daha sık gör.

Tercihli Kaynak Ekle

Anthropic, yapay zekâ araştırmaları ve geliştirme süreçlerindeki Claude’un nasıl kullanıldığına dair ilginç veriler sundu. Şirketin yayımladığı yeni blog yazısında, Claude’un Anthropic’in yapay zekâ Ar-Ge çalışmalarının yüzde 26’sında yüksek seviyeli komutlarla büyük ölçüde uçtan uca işlemleri gerçekleştirebildiği belirtilirken, insan çalışanların bu süreci denetlediği ifade ediliyor. Anthropic, bu çalışma şeklinin “AI-led” yani yapay zekâ tarafından yönlendirilmiş bir süreç olduğunu tanımlıyor. Ancak Claude’un rolü bununla sınırlı değil; yapay zekâ sistemleri, şirketin araştırma faaliyetlerinin yüzde 90’ından fazlasında en azından büyük bölümleri insan rehberliğinde yürütüyor.

Bu veriler, Claude’un şirket çalışanlarının araştırma faaliyetlerinin büyük bir bölümünde yer aldığını ortaya koymaktadır. Ancak Anthropic, yapay zekâ Ar-Ge çalışmalarının hiçbir kısmında Claude’un tamamen bağımsız hareket etmediğini vurguluyor. Bu, yapay zekânın bazı görevleri büyük ölçüde kendi başına tamamlayabilse de, insan gözetiminin sürecin ayrılmaz bir parçası olduğu anlamına geliyor. Şirketin belirttiği yüzde 26’lık “liderlik” oranında bile nihai denetim insan çalışanlara ait kalmaktadır. Bu durum, yapay zekâ araçlarının araştırma süreçlerindeki etkinliğini değerlendirirken sadece görev tamamlama oranlarına bakmanın yeterli olmayacağını göstermektedir.

Anthropic yapay zekâ gelişiminin ölçülmesi için üç yöntem öneriyor

Anthropic, yapay zekâ geliştirme hızını daha anlaşılır ve karşılaştırılabilir hale getirmeyi hedefleyen üç ölçüm yöntemini ortaya koydu. Bunlardan ilki “AI-led AI R&D” yaklaşımıdır ve yapay zekâ araştırma ve geliştirme süreçlerinin ne kadarının Claude tarafından yerine getirildiğini ölçmeye dayanıyor. Bunun için kendi kullanım verileri, Epoch AI tarafından hazırlanan otomasyon derecelendirme ölçeğiyle birleştirildi. Bu yöntemle Claude’un Ağustos 2025’ten bu yana ulaşmış olduğu otomasyon seviyelerini gösteren bir grafik oluşturuldu. Anthropic’e göre benzer bir ölçüm, başka ileri düzey yapay zekâ geliştiricileri tarafından da uygulanabilir ve sonuçlar bağımsız üçüncü taraflarca doğrulanabilir.

İLGİNİZİ ÇEKEBİLİR

Claude artık sohbet içinde Word belgeleri ve sunumlar hazırlayabiliyor

Claude artık sohbet içinde Word belgeleri ve sunumlar hazırlayabiliyor

OpenAI, Google ve Anthropic yapay zekâ güvenliğinde birlikte hareket ediyor

OpenAI, Google ve Anthropic yapay zekâ güvenliğinde birlikte hareket ediyor

Huawei, Nvidia’ya karşı yeni AI çipini beklenenden erken çıkaracak

Huawei, Nvidia’ya karşı yeni AI çipini beklenenden erken çıkaracak

Google mühendislerine Claude erişimi açtı: Kullanım Antigravity ile sınırlı

Google mühendislerine Claude erişimi açtı: Kullanım Antigravity ile sınırlı

Microsoft Auto SR, Panther Lake ile oyunlarda 1080p’ye çıkıyor

Microsoft Auto SR, Panther Lake ile oyunlarda 1080p’ye çıkıyor

Şirketin önerdiği ikinci ölçüm alanı, yapay zekâ ajanlarının denetim düzeyini ölçmeye yönelik. Bu ölçümde, ajan faaliyetlerinin ne kadarının insanları tarafından izlendiği, yapılan işlemlerin kontrol edilme süreleri ve sistem davranışlarının ne sıklıkla sorunlu olarak işaretlendiği gibi veriler takip edilecektir. Anthropic, bu tür göstergelerin, giderek daha bağımsız hareket edebilen yapay zekâ ajanlarının gerçek işleyişleri hakkında daha açık bilgiler sunabileceğine inanıyor. Ayrıca, belirli bir görevin tamamlanıp tamamlanmadığını ölçmek yerine, bu görevi ne kadar denetim altında gerçekleştirildiğinin de kaydedilmesi gerektiğini savunuyor. Böylece, şirketler arasında daha net karşılaştırmalar yapabilen bir güvenlik ve denetim çerçevesi oluşturmayı amaçlıyor.

Üçüncü ölçüm ise yapay zekâ araştırma ve geliştirme faaliyetleri için ayrılmış hesaplama gücünün takibini kapsıyor. Anthropic, şirketlerin Ar-Ge çalışmalarına ayırdığı işlem gücünün açıklanmasının, ileri düzey modellerin gelişim hızını belirlemek için faydalı olacağını ifade ediyor. Bu verilerin, otomasyon seviyesi ve insan denetimiyle birleştirilmesi durumunda sektörün gelişim hızı hakkında daha kapsamlı bir değerlendirme yapılabileceğini belirtiyor. Şirket, artan şeffaflığın hem kamuoyunun yapay zekâ geliştirme süreçlerini daha iyi izlemesine hem de sorunlu gelişmelere daha erken müdahale edilmesine yardımcı olabileceğini vurguluyor.

Günün Öne Çıkan Fırsatları

300 Hz ekranlı Game Garaj Slayer R9T, sepette 10.049,90 TL ucuzluyor
300 Hz ekranlı Game Garaj Slayer R9T, sepette 10.049,90 TL ucuzluyor

Satın Al

LG S40T soundbar ile 300 W ses, sepette 7.318,80 TL
LG S40T soundbar ile 300 W ses, sepette 7.318,80 TL

Satın Al

Google TV’li Next Stick 4K sepette 464,55 TL indirimli
Google TV’li Next Stick 4K sepette 464,55 TL indirimli

Satın Al

43 dB ANC’li QCY H3 kulaküstü kulaklık sepette 1.398 TL
43 dB ANC’li QCY H3 kulaküstü kulaklık sepette 1.398 TL

Satın Al

Havit TW984 ANC kulaklık, yüzde 15 sepet indirimiyle 636,65 TL
Havit TW984 ANC kulaklık, yüzde 15 sepet indirimiyle 636,65 TL

Satın Al

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.

Anthropic CEO’su Dario Amodei, yapay zekâ güvenliği ve gelişmiş modellerin denetlenmesi üzerine daha fazla ölçüm yapılması gerektiğini vurguladı. Ayrıca, OpenAI’nin de yapay zekâ gelişiminin gerektiğinde yavaşlatılabilmesine yönelik bir yaklaşımı benimsediği belirtiliyor. Anthropic, geliştirme süreçlerinin üçüncü taraflarca değerlendirilmesine izin verme taahhüdünde bulunuyor; ancak sektör genelindeki bağlayıcı denetim mekanizmalarının nasıl oluşacağı hâlâ belirsizliğini koruyor. Kaynak metne göre, ABD Başkanı Donald Trump, yapay zekânın risklerini kısıtlı bir çerçevede değerlendirdiği için düzenleyici yaklaşımın şirketlerin iç denetimlerinin ötesine geçip geçmeyeceği hakkında net bir görüş yok.

Anthropic’in açıklanan yüzde 26’lık oran, mevcut yapay zekâ sistemlerinin yalnızca kod yazma veya tekil araştırma görevlerini yerine getiren yardımcı araçlar olmaktan çıkmaya başladığının somut bir gösterilmesidir. Bununla birlikte, şirketin verileri Claude’un tam bağımsız bir araştırmacı gibi çalışmadığını, insan yönlendirmesi ve gözetiminin hâlâ belirleyici olduğunu ortaya koyuyor. Bu nedenle, açıklanan oranları doğrudan “işlerin dörtte birinin tamamen yapay zekâya bırakılması” olarak yorumlamak yanıltıcıdır. Daha doğru bir değerlendirme, Claude’un giderek daha fazla görevi yüksek seviyeli talimatlarla tamamlayabildiği, ancak insan denetiminin sürecin temel unsurlarından biri olmayı sürdürdüğü şeklindedir. Anthropic’in önerdiği ölçüm standartlarının sektörde benimsenip benimsenmeyeceği ise yapay zekâ şirketlerinin ne kadar detaylı veri paylaşmayı kabul edeceğine bağlı olacaktır.

Teknoblog artık WhatsApp’taGünün en iyi teknoloji fırsatları ve büyük haberlerden anında haberdar olun.

Kanala Katıl

Bir yanıt yazın