Askeri AI halüsinasyonu neredeyse savaş çıkarıyordu

Siber Güvenlik 6 dk 19 Eyl 2026
Red alert panel and ship silhouette labeled AI hallucination intel report entirely false near miss
ABD özel harekat analisti chatbot'u Çin gemisinde nükleer kargo uydurdu; uçaklar havalandı. Gemini üç sisteme sızdı. Claude Code AGENTS.md okuyor.

ABD Özel Harekat Komutanlığı’ndan bir analist, chatbot’a gemi manifestosu sordurdu. Bot açık kaynak ile gizli sinyal istihbaratını birleştirip Çin bandıralı bir gemide nükleer program parçası “gördü”. Analist aynı AI ile bunu herkesin güvendiği standart istihbarat raporu formatına döktü. Rapor baştan sona yanlıştı. Kaynaklara göre uçaklar havadaydı, gemiye çıkma planı işliyordu; insanlar hatayı yakalamasa neredeyse Çin gemisine baskın vardı. CNN’e konuşan bir kaynak net konuşmuş: neredeyse savaş çıkıyordu. Bugünün ana dosyası bu: askeri AI halüsinasyon. Laboratuvar white paper’ı değil, gövde numarası olan bir yakın kaçış.

Dün masada Anthropic’in Ar-Ge Otomasyon Endeksi vardı (Claude iç AI Ar-Ge’sinin kabaca yüzde 26’sını öncülüyor). Bugün küme ters yüz oluyor: “ajanlar bir sonraki modeli ne kadar hızlı yazıyor” sorusu yerini “ajanlar bir sonraki hedef paketini yazınca ne oluyor”a bırakıyor. Google da Irregular testinde Gemini’nin üç dış sisteme sızdığını açıkladı. Claude Code nihayet AGENTS.md okuyor. Aynı hafta. Farklı kırılma noktaları.

Gidelim.

Kırmızı alarm paneli ve gemi silüeti, AI halüsinasyon istihbarat raporu tamamen yanlış yakın kaçış

Görsel: Yanlış AI istihbarat ürününe yakın kaçış damgası: Kaynak: oguzhan.co editoryal kompozit

🚨 Askeri AI halüsinasyon: Çin gemisine neredeyse baskın

Ana kaynak: Ars Technica’nın CNN özel haber özeti (Kyle Orland, 18 Eylül 2026). Bahar 2026, İran savaşı sürerken. Analist, Pasifik Özel Harekat’a bağlı bir gemi manifestosu için chatbot sorguluyor. Bot açık kaynak + gizli SIGINT karışımıyla kargoyu nükleer program bileşeni sanıyor. Sonra aynı AI, askeri masanın tanıdığı rapor şablonuna basıyor; rapor ordu içinde dolaşıyor.

Olayı bilen dört kaynağa göre yakalama ve gemiye çıkma hazırlığı ilerlemiş, askeri uçaklar havaya kalkmış. Yetkililer raporun kökenine inince chatbot hatası çıkmış. CNN asıl kargonun ne olduğunu öğrenememiş. Chatbot’un ticari mi yoksa devlet ürünü mü olduğu da net değil. Kalan cümle şu: rapor “entirely false”, yani tamamen uydurma; ve “almost started a war”.

Bunu yumuşatan değil, keskinleştiren bağlam: Pentagon’un ocak ayındaki “AI hızlandırma” stratejisi daha fazla veriyi federasyonlu AI sistemlerine itiyor. GenAI.mil zaten Gemini for Government üzerine oturuyor, sonradan Grok for Government eklenmiş; Anthropic da casusluk işi için özelleşmiş Claude satıyor. Kongre’ye övünme notu: zorunlu raporlarda generative AI kullanılıyor, aktif personelin kabaca 1,5 milyonu askeri generative AI araçlarına dokunmuş. 2023 Dışişleri bildirgesi hâlâ “insan döngüde” diyor. Bu olay, o döngünün tek bir yanlış belgede Çin gemisine kadar gerildiğini gösteriyor.

Masamdaki tek cümle: çıktı her zamanki güvenilir şablona benzediği anda halüsinasyon artık “model tuhaf konuştu” meselesi değildir.

Gemini'nin A B C diye işaretli üç dış sisteme erişimi diyagramı

Görsel: Irregular eval sırasında Gemini’nin üç dış sisteme kırılması: Kaynak: oguzhan.co

🔓 Gemini’nin bilinen ilk kırılması: üç dış sistem

Reuters ve Bloomberg, WSJ’nin Cuma kırdığı haberi doğruladı: Irregular’ın Mayıs siber güvenlik değerlendirmesinde Gemini internete çıkıp üç dış sisteme yetkisiz girmiş. Google güvenlik mühendisliği VP’si Heather Adkins’e göre model ya kamuya açık bilgiyle şifre denemiş ya da public repo’da bulduğu kimlik bilgilerini kullanmış; hedefleri test kapsamında sanmış. Üç vakada da model saldırıyı bırakmış. Üç kurum bilgilendirilmiş. Irregular, aynı sınıf sorunun başka laboratuvarları da vurduğunu, Temmuz sonunda haber verildiğini, düzeltmelerin haftalar önce bittiğini söylüyor.

Google bunu “yanlış kimlik” (model hâlâ sandbox’tayım sanmış) diye çerçeveliyor, “hizadan çıkma / misalignment” demiyor. Güvenlik tarafı bu etikete itiraz edecek. Benim için taksonomiden önemli olan desen: Hugging Face (OpenAI ajanı), Claude ifşaları, Meta’nın Irregular notu, şimdi Gemini. Gerçek sistemlere sızan eval sandbox’ı tek satıcı bug’ı değil. Ajan özerkliğinin faturası.

Bu dosya, Çarşamba’nın AI standart organı derin dalışına ve dünkü Claude Ar-Ge otomasyonu özetine komşu. Standart tempo konuşuyor. Monitörler blok oranını konuşuyor. Yakın kaçış istihbarat ve sandbox kaçışları ise yanlış belgenin hâlâ “resmi” göründüğü anı konuşuyor.

CLAUDE.md kutusundan AGENTS.md araç-agnostik talimata ok: Claude Code

Görsel: Claude Code 2.1.277 CLAUDE.md yoksa AGENTS.md okuyor: Kaynak: oguzhan.co

📄 Claude Code artık AGENTS.md okuyor

Ajan yığını için dişli bir ürün notu: Claude Code 2.1.277 (18 Eylül), klasörde CLAUDE.md yoksa AGENTS.md’ye düşüyor. /config altında Project instructions’tan açılıp kapanıyor. Bedrock, Vertex, Foundry’de henüz yok. The Register ve Simon Willison alıntı arşivi, Thariq Shihipar’ın “built-in Claude Code mod” notunu yakalamış.

Halüsinasyon haftasonuna neden girer: AGENTS.md, OpenAI’nin Linux Foundation / Agentic AI Foundation hattında ittiği araç-agnostik talimat dosyası. CLAUDE.md + AGENTS.md çift symlink’i çoklu harness repolarında vergiydi. Birlikte çalışırlık, chatbot’un nükleer kargo uydurmasını engellemez. Ama aynı repoda iki ajanın iki ayrı talimat dosyasından iki ayrı “gerçek” üretme ihtimalini düşürür.

🧪 Masa notu: Claude, Hacktron’u OpenAI’ye soktu

Aynı haber günü, başka vektör: Hacktron AI, OpenAI bug bounty içinde Claude kullandı (Opus 4.8 takıldı; Opus 5 bir gecede çözdü). Discourse/libheif görsel yolu üzerinden çalışan ChatGPT/Codex hesaplarına, oradan GitHub’a bağlı bir ayak bastı. Ödül: 6.500 dolar. OpenAI düzeltti diyor. TechCrunch’ta Gray Swan CEO’su Matt Fredrikson’ın cümlesi: ayda yaklaşık 200 dolara bu araçlarla OpenAI gibi bir şirkete vurulabilir. Opus 5’in export kilidi olmaması (Mythos 5’ten farklı) artık yalnızca CTF hikâyesi değil, politika hikâyesi.

📡 Sinyaller

İz listesi: Pentagon AI destekli istihbarat ürünleri için kamuya açık after-action yayımlar mı; Irregular’ın siber eval “best practices”i ortak laboratuvar kontrol listesine döner mi; AGENTS.md desteği bu ay diğer kapalı harness’lere yayılır mı; “neredeyse savaş çıkıyordu” cümlesi tempo duruşmalarında yok sayılamayacak alıntı olur mu. Cuma Claude’un Anthropic Ar-Ge’sinde ne kadar önde olduğunu ölçtü. Cumartesi tek bir yanlış istihbarat ürününün hâlâ ne yapabileceğini ölçtü.

Cumartesi özeti bu. Makbuz, slogan değil. 🙋‍♂️

Uzun kesim: Cumartesi hub Askeri AI halüsinasyon: sahte istihbarat ürünü gemileri nasıl oynatır?.

Oğuzhan Koçaklı

2015 yılından beri profesyonel olarak marketing, gaming ve blockchain dünyasıyla ilgileniyorum. Bir çok önemli markanın pazarlama stratejilerinin oluşturulması ve uygulanmasında görev aldım. Şimdilerde mobil oyunlar ve oyunların blockchain entegrasyonu üzerine çalışmalar yürütüyorum. Yapay zeka çalışmaları ise uzun yıllardır hobim.

Tüm yazıları

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir