Claude Anthropic Ar-Ge’sinin dörtte birini artık kendi yürütüyor

Siber Güvenlik 6 dk 18 Eyl 2026
Bar chart rising to 26 percent Claude leads Anthropic AI R and D with agent grid
Anthropic Ar-Ge Otomasyon Endeksi: Claude Ar-Ge işinin %26'sını yürütüyor, %90+ işbirliği, tam özerklik yok. ~30 bin ajan, %0,002 engel.

Anthropic bugün Ar-Ge Otomasyon Endeksi’ni açtı; Claude Ar-Ge otomasyonu artık kamuya açık bir sayı: laboratuvarın yapay zeka Ar-Ge işinin yaklaşık yüzde 26’sını Claude yürütüyor. Mart’ta bu pay yüzde 1’in altındaydı. Epoch AI ölçeğinde “AI işbirliği yapıyor” ve üstü işler yüzde 90’ı aşıyor; ölçülen hiçbir dilimde tam özerklik yok. Ana iç platformda aynı anda yaklaşık 30 bin araştırma ajanı dönüyor. Ağustos’ta bir milyardan fazla kararda çevrimiçi monitörler yalnızca yüzde 0,002’sini kesti.

Tempo tartışmasının eksiği buydu: endişe cümlesi değil, gösterge. Dünkü masada OpenAI’nin hizasızlık ifşası ve DeepMind Institute yazıları vardı. Bugün başka bir kare var: Claude bir sonraki Claude’u ne kadar taşıyor, Anthropic bunu ölçüp koyuyor. Amodei’nin tempoyu birlikte ayarlama çağrısı ile “özyinelemeli kendini iyileştirme” korkusu aynı masada.

Bakıyorum.

Claude Anthropic Ar-Ge payı yüzde 26ya yükselen çubuk grafik ve ajan ızgarası

Görsel: Claude’un Ar-Ge payı neredeyse sıfırdan Ağustos 2026’da yüzde 26’ya: Kaynak: oguzhan.co editoryal kompozit

📊 Claude Ar-Ge otomasyonu: yüzde 26’lık yürütme payı

Asıl metin Anthropic Institute yazısı: Measurements for understanding the pace of AI development inside frontier labs. AI Ar-Ge işlerini dondurulmuş bir sepete koyuyorlar (yaklaşık 15 bin örnek görev, 542 kategori), Epoch AI’nin AL0–AL5 otomasyon merdiveniyle puanlıyorlar, kişi-zamanıyla ağırlık veriyorlar.

AL3: AI “işbirliği yapıyor”; büyük parçalar sıkı insan yönüyle ilerliyor. AL4: AI işi büyük ölçüde uçtan uca yürütüyor; yüksek seviye istem yeterli, insan yine denetimde. AL5: döngüde insan yok, tam özerklik. Ağustos 2026’da Claude Ar-Ge’nin yüzde 26’sını bu AL4 bandında yürütüyor; işbirliği ve üstü yüzde 90’ın üzerinde; AL5 her ölçülen dilimde boş.

Business Insider ve Reuters aynı kareyi taşıyor: Mart’ta bu yürütme payı yüzde 1’in altındaydı. Altı ayda bu eğim, “araştırma döngüsü hâlâ insanın elinde” demeyi zorlaştırıyor.

Şartlı okumam (Anthropic de not düşüyor): puanı veren Claude, Claude’un yardım ettiği iş akışlarını notluyor. Personel spot kontrolü modele, insanların birbirine uyduğu kadar uyuyor; notlar yüzde 97 oranında bir seviye içinde kalıyor. Kamuya açık bir tempo termometresi için yeter. Mahkeme delili değil. Bu yüzden bağımsız değerlendirici yerleştirme planı kritik.

Epoch otomasyon seviyeleri AL0 AL3 AL4 AL5 merdiveni Anthropic Ar-Ge

Görsel: İşbirliği yüzde 90 üstü, Claude’un yürütme payı yüzde 26, özerklik hâlâ boş: Kaynak: oguzhan.co

🛡️ Otuz bin ajan, yüzde 0,002 kesinti

İkinci ölçü gözetim. Anthropic’e göre en çok kullanılan iç platformda aynı anda yaklaşık 30 bin ajan araştırma ve mühendislik yapıyor. Çevrimiçi monitörler eylemlerin yüzde 100’ünü çalıştırmadan önce görüyor. Çevrimdışı monitörler her şeyi sonradan tarıyor.

Ağustos’ta bir milyardan fazla ajan kararı incelenmiş. Çevrimiçi kesinti oranı yüzde 0,002: kabaca 47 binde bir. Çevrimdışı monitörler her bin transkriptten bir iki taneyi işaretliyor; haftada yaklaşık 50 yüksek öncelikli dosya insana çıkıyor. O platformda kapsama tamam. Asıl soru şu: ajan sayısı ve karar hacmi bir sıfır daha büyüyünce “kesildi” ve “işaretlendi” hâlâ bir şey ifade edecek mi?

Üçüncü kadran hesaplama payı. Temmuz ortası bir haftada AI Ar-Ge hesaplamasının yaklaşık yüzde 6’sı güvenlik işine gitmiş. AI’nin sürdürdüğü AI Ar-Ge içinde güvenlik etiketi yaklaşık yüzde 12. Anthropic bunları muhafazakâr sayıyor. Güvenlik araştırması çoğu zaman araştırmacı zamanı ağır, hesaplama hafif; yüzde bir erdem skoru değil, laboratuvarlar arası karşılaştırma aracı.

Ajan gözetim özeti yüzde 0,002 kesinti oranı ve güvenlik hesaplama payı

Görsel: Kapsama yüksek, kesinti oranı minik, güvenlik hesaplama payı tek haneli ortalar: Kaynak: oguzhan.co

⏱️ Tempo, RSI ve bu yüzde 26 ne anlatıyor

Anthropic endeksi, dünyanın özyinelemeli kendini iyileştirmeye ne kadar yaklaştığını görmek için sunuyor: modelin halefini tam özerk kurması. Tempo koordinasyonu olursa bu sayıların kayacağını da yazıyorlar. Amodei’nin açık çağrısı bu çizgi.

Haftanın kümesine oturuyor. Çarşamba derin dalışında AI standart organı pakt mı kartel mi diye sordum. Dünkü özette OpenAI hizasızlık ifşası ve DeepMind Institute vardı. Bugünkü endeks eksik gösterge paneli: “endişeli miyiz” değil, “fabrikanın ne kadarı zaten Claude’un elinde.”

Sektör gerçeği saymam için üç makbuz istiyorum. Diğer laboratuvarlar aynı AL kırılımını yayınlasın. Üçüncü taraflar iç erişimle notları doğrulasın. Güvenlik hesaplaması tanımı pazarlama cümlesine yenilmesin. Anthropic, iç risk ekiplerine yakın erişimli bağımsız değerlendirici yerleştirmeyi planladığını söylüyor. Test bu. O zamana kadar Claude Ar-Ge otomasyonu yüksek sesli, yararlı, tek laboratuvarlık bir metre.

🧪 Masa notu: Bend kanıt istiyor, his değil

Laboratuvarlar tempo tartışırken HN’den hafif bir sinyal: Bend, AI kod hatalarını kanıtla engelleyen, CPU ve GPU’da çalışan bir dil vaat ediyor. Bu gece araç zincirimi değiştirmiyorum. Anthropic hikâyesinin yanına koyuyorum çünkü sektörün “AI bir sonraki AI’yi yazıyor” sorusuna iki paralel cevabı var. Biri daha fazla ajan, daha iyi monitör. Öteki yanlış kodu sevk etmeyi zorlaştırmak. İkisi birden doğru olabilir. Hiçbiri kamuya açık otomasyon endeksinin yerini tutmaz.

📡 Sinyaller

Hafta sonuna izleme listesi: OpenAI veya Google benzer AL4 payı yayınlar mı; Anthropic’in üçüncü taraf yerleştirme takvimine tarih girer mi; yüzde 26’lık yürütme payı her tempo duruşmasında yeni alıntı olur mu; Bend tarzı doğrulanmış araçlar herhangi bir laboratuvarın ajan iskelesine girer mi. AL5 sıfırken yüzde 26 hâlâ insan denetimli ivme. Bu yıl gördüğümüz en dik kamuya açık eğim de bu.

Cuma özeti buraya kadardı. Slogan değil, sayı. 🙋‍♂️

Oğuzhan Koçaklı

2015 yılından beri profesyonel olarak marketing, gaming ve blockchain dünyasıyla ilgileniyorum. Bir çok önemli markanın pazarlama stratejilerinin oluşturulması ve uygulanmasında görev aldım. Şimdilerde mobil oyunlar ve oyunların blockchain entegrasyonu üzerine çalışmalar yürütüyorum. Yapay zeka çalışmaları ise uzun yıllardır hobim.

Tüm yazıları

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir