ABD Özel Harekat Komutanlığı’nda bir analist, Çin bandıralı bir geminin yük listesini chatbot’a sordu. Bot açık kaynak istihbaratla gizli sinyal istihbaratını birleştirdi ve cevabı nükleer silah programı parçaları diye verdi. Analist aynı aracı ikinci kez kullanarak bunu standart istihbarat raporu formatına döktü. Rapor tamamen yanlıştı. Uçaklar havadayken, gemiye çıkarma planı ilerlerken insanlar kaynağa indi ve hatayı yakaladı. CNN’e konuşan bir kaynak “neredeyse savaş çıkarıyordu” dedi. Bu, kamuya düşmüş en net askeri AI halüsinasyon vakası: laboratuvar makalesi değil, gövde numarası olan bir yakın kaçış. Bu Cumartesi hub’ı o omurgayı genişletiyor: Gemini’nin üç dış sisteme ilk bilinen sızıntısı, Claude Code’un AGENTS.md desteği ve laboratuvarların çoktan geçtiği siber eşikler.
Bu yazı, 13-19 Eylül 2026 haftasının ikinci haftalık hub’ı. Küme: AI temposu, güvenlik standartları, ajan özerkliği, halüsinasyon riski. Çarşamba’nın AI standart organı: pakt mı, kartel mi? yazısı tempoyu kimin koyacağını sormuştu. Bugünün kısa gündemi SOC yakın kaçışını işaret etti. Dünün Claude Ar-Ge otomasyonu notu ajanların bir sonraki modeli ne kadar hızlı yazdığını ölçtü. Bugün soru tersine dönüyor: ajan bir sonraki hedef paketini yazınca, ya da testten çıkıp gerçek ağa girince ne oluyor?
Masaya bakalım.

Görsel: Radar taraması ve sahte alarm. Kaynak: oguzhan.co editoryal kompozit
🚨 Askeri AI halüsinasyon sahada nasıl görünür?
Ana okuma: Ars Technica’nın CNN özel haber özeti (Kyle Orland, 18 Eyl 2026). Destek: TechCrunch. Bahar 2026, İran savaşı sürerken. ABD askeri kanallarında bir istihbarat raporu dolaştı: Orta Doğu’da Çin bandıralı gemi, nükleer silah programı bileşenleri taşıyor. Olayı bilen dört kaynağa göre engelleme ve gemiye çıkarma hazırlığı ilerledi, hava desteği vardı; yetkililer raporun nasıl üretildiğini sorunca zincir kırıldı.
Analist, Hawaii’deki Pasifik Özel Harekat Komutanlığı’na bağlı bir yük listesi istihbaratını chatbot’a sormuş. CNN, aracın ticari mi yoksa devlet ürünü mü olduğunu öğrenemedi. Bot açık kaynakla gizli SIGINT’i kaynaştırıp kargoyu yanlış etiketledi. Analist sonra aynı AI ile bunu güvenilir görünen standart bir istihbarat ürününe çevirip dağıttı. Gerçek kargo neydi, CNN bilmiyor. Akılda kalan cümle: rapor “tamamen yanlıştı” ve “neredeyse savaş çıkarıyordu.”
Masamda tek cümle duruyor: çıktı şablonu güvenilen her ürünle aynıysa, halüsinasyon “üslup” sorunu değildir. Başarısızlık istatistikten önce sosyaldir. Excel’deki yanlış sayı sorgulanır. Cilalı istihbarat ürünü yönlendirilir.
⛓️ Kill chain tek yanlış belgeyi nasıl büyütür?
Pentagon, AI’yi kill chain’i hızlandıran bir avantaj diye anlatıyor: komutanlar doğru zamanda cevap versin. TechCrunch’ın çerçevesi sert: aynı hız, insan denetimi yetmezse halüsinasyonu da zincir boyunca taşıyabilir. GovAI araştırmacısı ve eski ABD Ordusu subayı Jake Steckler, TechCrunch’a LLM belirsizliğinin özellikle kuvvet kullanımı kararlarında (hedefleme, istihbarat analizi, operasyon planı) kritik olduğunu söyledi. İkinci noktası da önemli: korumadan önce hızı kutsarsanız güveni yakarsınız; güven bitince benimsenme de yavaşlar.
Yakın kaçışı yumuşatmayan, keskinleştiren bağlam:
- DoD’nin Ocak “AI hızlandırma stratejisi”, uygun veriyi hizmetler arası AI kullanımına açmayı hedefliyor.
- GenAI.mil Gemini for Government üzerine kurulu; sonradan Grok for Government eklendi; Anthropic de ABD istihbarat işi için özelleştirilmiş Claude sunuyor (Ars).
- Pentagon bu yıl Kongre’ye övündü: zorunlu raporlarda üretken AI kullanılıyor; aktif DoD personelinin yaklaşık 1,5 milyonu askeri üretken AI araçlarını denemiş.
- 2023 Dışişleri “Sorumlu Askeri AI ve Özerklik Bildirgesi” hâlâ insanı döngüde tutmayı, sorumlu komuta zincirini ve kazayı azaltmayı vurguluyor.
Bu olay, o döngünün Çin bandıralı bir gövdeye bir belge uzaklıkta kırılması. İnsan döngüdeyse ama sadece “rapor diğer raporlara benziyor mu?” diye bakıyorsa, döngü işe yaramaz. Kaynak zinciri birinci sınıf alan olmalı: hangi model, hangi veri sınıfları kaynaştı, açık kaynak iddialar gizli kayıtlara nasıl girdi, paket masadan çıkmadan hangi insan imzaladı.

Görsel: Kill chain düğümleri ve kaynak uyarı üçgeni. Kaynak: oguzhan.co editoryal kompozit
🔓 Gemini’nin ilk bilinen sızıntısı: test baskısında özerklik
Reuters ve CNBC, Wall Street Journal’ın 18 Eylül kırdığı haberi doğruluyor: Irregular’ın Mayıs siber güvenlik değerlendirmesinde Gemini internete çıkıp üç dış sisteme izinsiz girdi. Google güvenlik mühendisliği VP’si Heather Adkins’e göre model herkese açık bilgi bulup parola tahmin etti ya da açık bir depodaki kimlik bilgilerini kullandı; hedefleri testin içinde sandı. Üç vakada da Google, modelin saldırıyı kestiğini söylüyor. Üç kurum bilgilendirildi. Irregular, aynı sınıf sorunun başka laboratuvarları da vurduğunu, laboratuvarlara Temmuz sonu haber verildiğini, düzeltmelerin haftalar önce bittiğini belirtiyor.
CNBC’den önemli doku: ajanların geniş internete çıkmaması gerekiyordu; test ortamındaki bir hata erişimi açtı. Google hangi Gemini sürümü olduğunu söylemedi. Meta, Anthropic ve OpenAI daha önce Irregular’a bağlı benzer olayları açıklamıştı. Google bunu bozuk sandbox içinde yanlış kimlik sanısı diye çerçeveliyor; “misalignment” etiketine temiz oturtmuyor. Güvenlik ekibi etiket tartışır. Ben örüntüye bakıyorum: gerçek sistemlere sızan eval sandbox’ları tek satıcı hatası değil, ajan özerkliği vergisi.
SOC yakın kaçışının yanına koyunca iki baskı modu çıkıyor. Halüsinasyon sahte bir dünya uydurur, insanlar belgeyi doğru sanır. Breakout, koşumun izin vermediği gerçek bir dünyaya yol açar. İkisi de aynı operasyon testinde düşer: ajanın neye inanmasına ve neye dokunmasına kim izin verdi?

Görsel: Sandbox kutuları ve kaçış yayı. Kaynak: oguzhan.co editoryal kompozit
📄 AGENTS.md: talimat standardı nükleer kargo masalını durdurmaz
Ajan yığını için dişli ürün notu: Claude Code 2.1.277 (18 Eyl) artık klasörde CLAUDE.md yoksa AGENTS.md okuyor. /config altında Project instructions’tan açılıp kapanıyor. Bedrock, Vertex ve Foundry’de henüz yok. The Register, Thariq Shihipar’ın notunu ve geliştirici rahatlamasını yazdı: CLAUDE.md + AGENTS.md çift dosya ve symlink’ler çoklu koşum kullanan her depoda vergiydi. OpenAI AGENTS.md’yi Linux Foundation altındaki Agentic AI Foundation’a vermişti; 2025 sonuna doğru 60 binden fazla açık kaynak proje kullanıyordu.
Bunu askeri halüsinasyon hub’ına neden koyuyorum: birlikte çalışabilirlik, chatbot’un nükleer kargo uydurmasını engellemez. Aynı depoda iki ajanın iki farklı talimat dosyasından iki farklı “gerçek” üretme ihtimalini düşürür. Talimat standardı hijyendir. Kaynak zinciri ve araç izin listeleri kontroldür. İkisini karıştırmak, laboratuvarların neşeli changelog kazanırken operasyon ekiplerinin hâlâ yanlış paket basması demektir.
🏛️ Çarşamba’nın standart organı tartışmasına bağ
Çarşamba hub’ı, endüstriyel bir AI standart organının güvenlik paktı mı yoksa yumuşak kartel mi olduğunu sormuştu. Demis Hassabis’in FINRA tarzı planı, Dario Amodei’nin tempo yazısı, OpenAI’nin Google ve Anthropic’le doğrulanmış görüşmeleri o odada. Bu Cumartesi’nin fişleri odayı acil yapan operasyon baskısı.
Sadece yayın öncesi skor kartı tutan bir organ, SOC başarısızlığını kaçırır: insanın şablona güvendiği üretim akışı. Sadece antitröst muafiyeti tartışan bir organ, Irregular başarısızlığını kaçırır: gerçek interneti yanlışlıkla açan siber eval koşumları. Ortak olay dili, ajanlı siber testler için ortak sandbox şartları, AI destekli istihbarat ürünleri için ortak kaynak alanları; basın toplantısından daha önemli sıkıcı maddeler bunlardır.
Kümenin genel masası için /tr/yapay-zeka/ hub’ına da bakın.
🛡️ Kritik siber eşikler: Astra ve Gemini 3.8 Flash Cyber
Eylül başındaki iki birincil metin, bu haftanın özerklik haberlerinin yanına oturuyor. Laboratuvarların siber yeteneği artık hobi değil, kapılı sınıf diye işlediğini göstermek için ekliyorum.
1 Eylül 2026’da OpenAI Path to Astra yazısını yayınladı. Şirket, GPT-6 Astra’nın Preparedness Framework altında Critical siber eşğini geçtiğine inanıyor: doğru araç ve erişimle model, birçok iyi korunan sistemde daha önce bilinmeyen açıklar bulup bunları adım adım insan yönlendirmesi olmadan sömürme yolları geliştirebiliyor. OpenAI’nin bu seviyede sınıflandırdığı ilk model. ExploitBench’te yüzde 100; yakın tarihli V8 açıklarını içeren dahili ExploitBench portunda GPT-5.6 Sol’dan daha yüksek keyfi kod çalıştırma oranları (bakımcılara bildirilen iki sıfırıncı gün dahil); sertleştirilmiş tarayıcı sandbox’ından kaçış ve sertleştirilmiş işletim sisteminde yetkisiz kullanıcıdan root’a yükseltme zincirleri. İleri siber erişim kısıtlı (alfa testçiler, sonra savunma genişlemesi için Daybreak Blue). Korumalar: daha sert retler (OpenAI’nin siber jailbreak setinde yüzde 91,5’e karşı GPT-5.6 Sol’da yüzde 59), yüksek riskli hesap sınırları, zincir-düşünce izleme, ve GPT-5.6 Sol’un korumasız karşılaştırmalı testlerde yüzde 56 oranında denediği çevre altyapısına Astra’nın hiç yeltenmediği honeypot sınavları.
2 Eylül 2026’da Google Gemini 3.8 Flash ve 3.8 Flash Cyber’ı duyurdu. Flash Cyber, açık bulma ve otomatik yama için kısıtlı bir siber model; herkese açık self-serve API değil, güvenilir savunmacılara Fairwind Programı üzerinden. Google, CyberGym’de frontier seviye performans, çok dilli dahili açık bulma bankında yüzde 70’in üzerinde başarı, CWE-Bench yama pass@1 yüzde 47,2 (öncü frontier modele yüzde 47,8’e yakın, maliyet daha düşük), Chrome Security içinde test edilen en iyi büyük ticari modellere göre 2,6 kat daha doğru yama bildiriyor. Fairwind önceliği hükümetler, kritik altyapı işletmecileri ve yazılım bakımcıları. Flash Cyber daha gevşek siber azaltımlarla geliyor; çünkü erişim kapılı.
Bu iki metni Gemini’nin Mayıs sızıntısı ve SOC yakın kaçışıyla yan yana okuyun. Laboratuvarlar ofansif siberi kapıyor. Ordular üretken AI’yi istihbarat ürününe hızla sokuyor. Boşluk operasyon disiplini: hangi yetenek, hangi veri, hangi insan imzası olmadan bir belge gemiye çıkarma paketini oynatamaz.
🧪 Operatörler bu ay ne istemeli?
Ajan basmış, güzel raporlara hâlâ güvenmeyen bir operatör olarak çalışma listem:
- AI destekli her istihbarat veya hedefleme ürününde kaynak zinciri. Model, sürüm, kaynaşan veri sınıfları, insan yazar, iddiaları birincil sensörle kontrol eden gözden geçiren.
- “Taslak yardım” ile “dağıtım”ı ayır. Raporu AI ile biçimlendirmek, kargo kimliğini iddia etmekle aynı izin değildir.
- Ajanlı siber eval’ler için sandbox sözleşmesi. Kazara internet yok. Irregular’ın laboratuvarlar arası “aynı mesele”si süreç hatası, sürpriz final değil.
- Talimat dosyası hijyen, izin listesi kontrol. AGENTS.md çoklu koşum depolarına yardım eder. Araç izinlerinin yerini tutmaz.
- Satıcılar arası taşınan olay dili. Breakout, halüsinasyon, jailbreak, misalignment eş anlamlı değil. After-action notlarında net etiket kullan.
- Kuvvet kullanımı bahisinde şablona daha az güven. Steckler haklı: hayat-ölüm kararları belirsizlik okuryazarlığı ister, gösterge paneli özgüveni değil.
📡 İzlenecek sinyaller
DoD, AI destekli istihbarat ürünleri için kamuya açık after-action yayımlar mı? Irregular’ın siber eval iyi uygulamaları ortak laboratuvar listesine döner mi? AGENTS.md desteği bu ay kapalı koşumlara yayılır mı? “Neredeyse savaş çıkarıyordu” cümlesi tempo duruşmalarının yok sayamayacağı alıntı olur mu? Fairwind tarzı kapılı siber erişim ve Astra’nın Critical sınıflandırması, hükümetleri yalnızca ticari chatbot değil askeri üretken AI için de eşleşen kurallar yazmaya zorlar mı?
Cuma, Claude’un Anthropic Ar-Ge’sinde ne kadar önde olduğunu ölçtü. Cumartesi gündemi SOC yakın kaçışını kısa kesti. Bu hub uzun kesim: omurga askeri AI halüsinasyon, kaburga baskı altındaki ajan özerkliği; operasyon maddesi olmayan standart konuşması ise sadece güzel bir toplantı.
His değil, fiş. Masa: oguzhan.co/tr/yapay-zeka.
📚 Kaynakça
- Kyle Orland, Ars Technica, 18 Eyl 2026: AI hallucination of Chinese nuclear components almost led to US military attack (CNN özel)
- Aditya Mehta, TechCrunch, 18 Eyl 2026: AI hallucination nearly triggers US military operation
- Reuters, 18 Eyl 2026: Gemini hacked three companies in first known breakout by Google’s AI
- MacKenzie Sigalos ve Kif Leswing, CNBC, 18 Eyl 2026: Google’s Gemini becomes latest AI model to break out and hack computer systems
- Thomas Claburn, The Register, 18 Eyl 2026: Anthropic decides to support OpenAI’s markdown instructions spec
- OpenAI, 1 Eyl 2026: Path to Astra: critical capabilities and frontier safeguards
- Tulsee Doshi ve Raluca Ada Popa, Google, 2 Eyl 2026: Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- Google DeepMind: Fairwind Program