Washington, İngiliz AI testçilerini ikinci sıraya aldı

Siber Güvenlik 6 dk
Abstract US security gate between a glowing AI model vault and a distant UK testing institute across dark water, no logos
Washington, ABD güvenlik incelemesi bitene kadar OpenAI ve Anthropic'in yeni frontier modellerini İngiliz devlet testçilerine açmamasını istedi.

Washington, OpenAI ile Anthropic’ten yeni frontier modellerini ABD’deki güvenlik incelemesi tamamlanmadan İngiltere AI Security Institute ile paylaşmamalarını istedi. Politico’nun ortaya çıkardığı talep, Anthropic cephesinde çoktan uygulandı: Claude Mythos 5.1 yalnızca ABD’deki Project Glasswing ortaklarına açıldı. Aynı günlerde DeepMind, Gemini 4’ü erkene çekmeye; Google’ın kurumsal ekibi ise Gemini 3.8 Live’a konuşan bir yüz takmaya çalışıyor.

🔒 Modeli önce Washington görecek

Parlayan AI model çekirdeği ile uzak test laboratuvarı arasında buzlu cam güvenlik kapısı
Washington, frontier modeller ile İngiltere AI Security Institute arasına kilit koyuyor.

Talep Beyaz Saray’a bağlı Office of the National Cyber Director’dan geldi. Yönetimdeki üst düzey bir yetkilinin gerekçesi hayli açık: Şirketler Amerikalı ve her yeni frontier model için izlenen politika bu. Önce ABD inceleyecek, uygun görürse müttefiklerin sırası gelecek.

İngiltere açısından ilk sonuç 1 Eylül’de çıktı. Anthropic, Claude Mythos 5.1’i piyasaya sürmeden önce Project Glasswing içinde test ettirdi fakat bu kez AISI’yi listeye almadı. AI Weekly’nin aktardığına göre bu, İngiliz kurumunun Anthropic’in yayın öncesi testlerinden ilk defa dışarıda kalması. Şirket modeli şimdilik “bir grup ABD kuruluşuna” sunduğunu, yerli ve uluslararası ortaklara erişimi mümkün olan en kısa sürede genişleteceğini söylüyor. Takvim yok.

Kapı tamamen kapanmış da değil. AISI Direktörü Henry de Zoete, laboratuvarlarla ilişkilerinin güçlü olduğunu ve bazı modellere yayın öncesinde hâlâ eriştiklerini belirtti. Verdiği örnek OpenAI’ın GPT-6 Astra modeli. Demek ki karşımızda Londra ile Washington arasında topyekûn bir kopuş değil, her modelde yeniden kurulabilecek bir sıra var. Sıranın başını da Washington tutuyor.

Bu ayrım önemli. AISI, devlet eliyle model güvenliği test eden en güçlü ve iyi finanse edilen ekiplerden biri. Kurumun hazırladığı yayın öncesi değerlendirmeler, tehlikeli yeteneklere ilişkin bağımsız bir ölçü kabul ediliyordu. Modeli daha geç görürse o ölçünün zamanı da kapsamı da ABD’nin ve modeli üreten şirketin kararına biraz daha bağımlı olacak. İngiliz hükümeti sözcüsünün itirazı bu yüzden yerinde: Riskler ülke sınırında durmuyor, tek bir ülkenin altından kalkacağı türden de değil.

Zamanlama ayrıca manidar. OpenAI’ın bir test agent’ı kısa süre önce Avustralya devlet sistemlerine, Medicare ile bağlantılı bir hizmet dahil, erişti. Dünkü yazıda ayrıntılarını anlattım; burada yeniden açmayayım. Ancak devletlerin “modeli kim, ne zaman kurcalayacak?” sorusuna neden daha sert yaklaştığını gösteriyor. Agent’ların sınırları zorlamasına ilişkin önceki sandbox vakası da aynı dosyanın teknik tarafı.

Şimdilik yanıtsız kalan soru şu: Aynı talep Google DeepMind ve Meta’ya da gitti mi? Kamuya yansıyan haberlerde buna dair doğrulama yok. Yetkilinin “Amerikan şirketleri” sözü ise listenin iki isimle sınırlı olmayabileceğini düşündürüyor.

🚀 Koray Kavukcuoglu’nun önceliği: Gemini 4’ü çıkarmak

Karanlık cleanroomda ışıltılı neural wafer'ların bir fırlatma portalına aktığı montaj hattı
DeepMind Kavukcuoglu döneminde: Gemini 4’ü çıkar, AGI sohbetini ertele.

Google DeepMind’ın günlük yönetimini ağustosta devralan Koray Kavukcuoglu, yeni görevindeki ilk medya buluşmasına hayli dünyevi bir hedefle çıktı. Gemini 4 erken post-training aşamasında. Kavukcuoglu sonuçları gördüklerini, heyecanlandıklarını ve bu aşamadan çıkan bir sürümü “mümkün olan en kısa sürede” yayınlamak istediklerini söyledi. Hedef, 2026 sonundan çok daha erken.

Model şimdiden şirket içinde Antigravity adlı coding aracını çalıştırıyor. Güvenlik testleri ve koruma önlemleri ise sürüyor. Yani ortada yalnızca adı konmuş bir eğitim koşusu yok; Google mühendislerinin gerçek iş akışında kullandığı bir sistem var.

Acele etmeleri şaşırtıcı değil. Google’ın son yeni amiral gemisi modeli Kasım 2025’te gelen Gemini 3 serisiydi. Şubattaki Gemini 3.1 Pro ise The Decoder’ın deyişiyle bir güncellemeydi. I/O sahnesinde haziran için işaret edilen Gemini 3.5 Pro ise gelmedi. Kavukcuoglu, öğrenme hızını artırmak ve Flash modellerine yoğunlaşmak için biraz geri çekildiklerini anlatıyor. O arada Anthropic Mythos, Fable ve Opus tarafını ilerletti; OpenAI da eylül başında GPT-6’yı yayınladı. The Verge’ün AI Agenda Live Summit haberi bu yüzden bir zafer konuşmasından ziyade üretim bandını hızlandırma brifingine benziyor.

Asıl değişiklik takvimden çok dilde. Kavukcuoglu’na göre “AGI’ye ulaştık mı?” tartışması doğru soru değil; güvenebileceğimiz akıllı agent’lar üretip üretemediğimize bakmak gerekiyor. Oysa Demis Hassabis birkaç hafta önceki veda notunda AGI’nin yakınlığından ve hayatının işinden söz ediyordu. Hassabis artık DeepMind Başkanı ve Alphabet Chief Scientist’i. Operasyonun başındaki Kavukcuoglu ise ekibin daima frontier çizgisinde kalacağından emin konuşuyor.

Bir de kadro kaybı var. Noam Shazeer OpenAI’a, John Jumper Anthropic’e geçti; Jeff Dean ve Oriol Vinyals gibi kıdemli isimler başka çalışmalara yöneldi. Buradan “DeepMind AGI’den vazgeçti” sonucu çıkarmam. Yeni yönetimin önce gösterebileceği bir sonuca, rekabetçi bir Gemini sürümüne ihtiyaç duyduğunu söylerim. Kavukcuoglu için bugün asıl soru, yayın düğmesine ne zaman basacağı.

🎭 Kurumsal Gemini agent’larına yüz geldi

Google yalnızca sıradaki modeli yetiştirmiyor. Mevcut Gemini 3.8 Live’a eklenen Live Avatar, kurumsal agent’ların çizgi karakter ya da gerçekçi insan görünümünde, üretilen sesle dudak hareketlerini eşleştirerek konuşmasını sağlıyor. Hazır karakter kütüphanesi kullanılabiliyor; şirketin izin listesine eklediği özel avatarlar da sisteme alınabiliyor.

Live Avatar 97 dili destekliyor. Görsel bağlamı anlayabiliyor, konuşurken arka planda veri çekebiliyor ve araç çağırabiliyor. Google’ın örneklerinden biri otel check-in işlemi. DeepMind araştırmacısı Shuo-yiin Chang ile Gemini yazılım mühendisi CJ Zheng, Google’ın duyuru yazısında bunu hizmet agent’ları için daha doğal bir arayüz olarak sunuyor. The Register ise işin güven tarafını kurcalıyor.

Çünkü insan yüzüne ve sesine yaklaşan yazılımların kullanıcıda nasıl bir güven yarattığı hâlâ araştırılıyor. İnsanlar ekrandaki karaktere daha çok bilgi verir mi? Akıcı dudak hareketleri, hatalı bir cevabı olduğundan emin mi gösterir? Sorular açık. Ürün ise satışta.

Haftanın Google fotoğrafı böyle: Bir ekip Gemini 4’ü erkene almaya uğraşıyor, diğeri bugünkü modele göz ve ağız ekliyor. Otel bankosunda işe yarayabilir. Ben yine de dudak hareketinden önce arka plandaki güvenlik testine bakarım.

Oğuzhan Koçaklı

2015 yılından beri profesyonel olarak marketing, gaming ve blockchain dünyasıyla ilgileniyorum. Bir çok önemli markanın pazarlama stratejilerinin oluşturulması ve uygulanmasında görev aldım. Şimdilerde mobil oyunlar ve oyunların blockchain entegrasyonu üzerine çalışmalar yürütüyorum. Yapay zeka çalışmaları ise uzun yıllardır hobim.

Tüm yazıları

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir