Claude’un Anthropic içindeki rolü beklenenden daha önemli hale geldi.
Anthropic, yapay zekâ araştırmaları ve geliştirme süreçlerindeki Claude’un nasıl kullanıldığına dair ilginç veriler sundu. Şirketin yayımladığı yeni blog yazısında, Claude’un Anthropic’in yapay zekâ Ar-Ge çalışmalarının yüzde 26’sında yüksek seviyeli komutlarla büyük ölçüde uçtan uca işlemleri gerçekleştirebildiği belirtilirken, insan çalışanların bu süreci denetlediği ifade ediliyor. Anthropic, bu çalışma şeklinin “AI-led” yani yapay zekâ tarafından yönlendirilmiş bir süreç olduğunu tanımlıyor. Ancak Claude’un rolü bununla sınırlı değil; yapay zekâ sistemleri, şirketin araştırma faaliyetlerinin yüzde 90’ından fazlasında en azından büyük bölümleri insan rehberliğinde yürütüyor.
Bu veriler, Claude’un şirket çalışanlarının araştırma faaliyetlerinin büyük bir bölümünde yer aldığını ortaya koymaktadır. Ancak Anthropic, yapay zekâ Ar-Ge çalışmalarının hiçbir kısmında Claude’un tamamen bağımsız hareket etmediğini vurguluyor. Bu, yapay zekânın bazı görevleri büyük ölçüde kendi başına tamamlayabilse de, insan gözetiminin sürecin ayrılmaz bir parçası olduğu anlamına geliyor. Şirketin belirttiği yüzde 26’lık “liderlik” oranında bile nihai denetim insan çalışanlara ait kalmaktadır. Bu durum, yapay zekâ araçlarının araştırma süreçlerindeki etkinliğini değerlendirirken sadece görev tamamlama oranlarına bakmanın yeterli olmayacağını göstermektedir.
Anthropic yapay zekâ gelişiminin ölçülmesi için üç yöntem öneriyor
Anthropic, yapay zekâ geliştirme hızını daha anlaşılır ve karşılaştırılabilir hale getirmeyi hedefleyen üç ölçüm yöntemini ortaya koydu. Bunlardan ilki “AI-led AI R&D” yaklaşımıdır ve yapay zekâ araştırma ve geliştirme süreçlerinin ne kadarının Claude tarafından yerine getirildiğini ölçmeye dayanıyor. Bunun için kendi kullanım verileri, Epoch AI tarafından hazırlanan otomasyon derecelendirme ölçeğiyle birleştirildi. Bu yöntemle Claude’un Ağustos 2025’ten bu yana ulaşmış olduğu otomasyon seviyelerini gösteren bir grafik oluşturuldu. Anthropic’e göre benzer bir ölçüm, başka ileri düzey yapay zekâ geliştiricileri tarafından da uygulanabilir ve sonuçlar bağımsız üçüncü taraflarca doğrulanabilir.
İLGİNİZİ ÇEKEBİLİR
Claude artık sohbet içinde Word belgeleri ve sunumlar hazırlayabiliyor
OpenAI, Google ve Anthropic yapay zekâ güvenliğinde birlikte hareket ediyor
Huawei, Nvidia’ya karşı yeni AI çipini beklenenden erken çıkaracak
Google mühendislerine Claude erişimi açtı: Kullanım Antigravity ile sınırlı
Microsoft Auto SR, Panther Lake ile oyunlarda 1080p’ye çıkıyor
Şirketin önerdiği ikinci ölçüm alanı, yapay zekâ ajanlarının denetim düzeyini ölçmeye yönelik. Bu ölçümde, ajan faaliyetlerinin ne kadarının insanları tarafından izlendiği, yapılan işlemlerin kontrol edilme süreleri ve sistem davranışlarının ne sıklıkla sorunlu olarak işaretlendiği gibi veriler takip edilecektir. Anthropic, bu tür göstergelerin, giderek daha bağımsız hareket edebilen yapay zekâ ajanlarının gerçek işleyişleri hakkında daha açık bilgiler sunabileceğine inanıyor. Ayrıca, belirli bir görevin tamamlanıp tamamlanmadığını ölçmek yerine, bu görevi ne kadar denetim altında gerçekleştirildiğinin de kaydedilmesi gerektiğini savunuyor. Böylece, şirketler arasında daha net karşılaştırmalar yapabilen bir güvenlik ve denetim çerçevesi oluşturmayı amaçlıyor.
Üçüncü ölçüm ise yapay zekâ araştırma ve geliştirme faaliyetleri için ayrılmış hesaplama gücünün takibini kapsıyor. Anthropic, şirketlerin Ar-Ge çalışmalarına ayırdığı işlem gücünün açıklanmasının, ileri düzey modellerin gelişim hızını belirlemek için faydalı olacağını ifade ediyor. Bu verilerin, otomasyon seviyesi ve insan denetimiyle birleştirilmesi durumunda sektörün gelişim hızı hakkında daha kapsamlı bir değerlendirme yapılabileceğini belirtiyor. Şirket, artan şeffaflığın hem kamuoyunun yapay zekâ geliştirme süreçlerini daha iyi izlemesine hem de sorunlu gelişmelere daha erken müdahale edilmesine yardımcı olabileceğini vurguluyor.
Günün Öne Çıkan Fırsatları





REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Anthropic CEO’su Dario Amodei, yapay zekâ güvenliği ve gelişmiş modellerin denetlenmesi üzerine daha fazla ölçüm yapılması gerektiğini vurguladı. Ayrıca, OpenAI’nin de yapay zekâ gelişiminin gerektiğinde yavaşlatılabilmesine yönelik bir yaklaşımı benimsediği belirtiliyor. Anthropic, geliştirme süreçlerinin üçüncü taraflarca değerlendirilmesine izin verme taahhüdünde bulunuyor; ancak sektör genelindeki bağlayıcı denetim mekanizmalarının nasıl oluşacağı hâlâ belirsizliğini koruyor. Kaynak metne göre, ABD Başkanı Donald Trump, yapay zekânın risklerini kısıtlı bir çerçevede değerlendirdiği için düzenleyici yaklaşımın şirketlerin iç denetimlerinin ötesine geçip geçmeyeceği hakkında net bir görüş yok.
Anthropic’in açıklanan yüzde 26’lık oran, mevcut yapay zekâ sistemlerinin yalnızca kod yazma veya tekil araştırma görevlerini yerine getiren yardımcı araçlar olmaktan çıkmaya başladığının somut bir gösterilmesidir. Bununla birlikte, şirketin verileri Claude’un tam bağımsız bir araştırmacı gibi çalışmadığını, insan yönlendirmesi ve gözetiminin hâlâ belirleyici olduğunu ortaya koyuyor. Bu nedenle, açıklanan oranları doğrudan “işlerin dörtte birinin tamamen yapay zekâya bırakılması” olarak yorumlamak yanıltıcıdır. Daha doğru bir değerlendirme, Claude’un giderek daha fazla görevi yüksek seviyeli talimatlarla tamamlayabildiği, ancak insan denetiminin sürecin temel unsurlarından biri olmayı sürdürdüğü şeklindedir. Anthropic’in önerdiği ölçüm standartlarının sektörde benimsenip benimsenmeyeceği ise yapay zekâ şirketlerinin ne kadar detaylı veri paylaşmayı kabul edeceğine bağlı olacaktır.

