Claude Haiku 5.5 ile fiyat tabanı on sente indi

Teknoloji 8 dk
Two small glass orbs, one coral and one teal, resting side by side on a glowing amber line across a dark floor
Anthropic küçük model fiyatında GPT-6 Luna ile buluştu, ChatGPT görsel arayüze geçti, Microsoft yerel ajanlar için güçlü bir cihaz çıkardı.

Claude Haiku 5.5, bir milyon input token için on sentlik fiyatıyla GPT-6 Luna’nın yanına geldi. Ajan kuranların bütçesini asıl kemiren yüzlerce küçük çağrı artık hayli ucuz. Çarşamba gününe GPT-6, yerel çalışan Microsoft modelleri, herkese açılan SynthID ve OpenAI’dan çıkarılan üç araştırmacının chain of thought mektubu da sığdı.

💸 Claude Haiku 5.5 ile küçük model fiyatı on sent

Uzun ve alçak turkuaz bir platformda belge ve veritabanı paketi taşıyan onlarca küçük küp robot
Haiku 5.5, 100 bin token’a kadar olan isteklerde milyon input token başına 0,10 dolar istiyor, GPT-6 Luna’nın API liste fiyatıyla aynı. 100 binin üstünde fiyat beş katına, 0,50 dolara çıkıyor.

Anthropic’in duyurduğu tarife 100K token sınırına kadar şöyle: bir milyon token için input $0,10, output $0,50, cache read $0,01. OpenAI’ın kısa context için GPT-6 Luna API fiyatı da kuruşu kuruşuna aynı. İki şirket küçük modellerini tam olarak aynı etikete koydu.

Fakat 100K aşılınca hesap değişiyor. Haiku’nun input ücreti $0,50’ye, output ücreti $2,50’ye, cache read ise $0,05’e çıkıyor. Anthropic, Haiku 4.5 isteklerinin yaklaşık yüzde 90’ının bu eşiğin altında kaldığını söylüyor. Kısa istekler yüzde 90 ucuzladı. Yeni tokenizer görev başına biraz daha fazla token harcadığı için ortalama tasarruf yaklaşık yüzde 75. Haiku 4.5’te input $1, output $5’ti.

Liste fiyatları yan yana (milyon token başına, ABD doları):

Model ve context Input Output
Claude Haiku 5.5, 100K token’a kadar $0,10 $0,50
Claude Haiku 5.5, 100K token üstü $0,50 $2,50
GPT-6 Luna, kısa context $0,10 $0,50
Claude Haiku 4.5 $1 $5

Anthropic’in saydığı işler gösterişsiz ama bol: özetleme, context compaction, veritabanı sorguları, sınıflandırma, müşteri desteği ve browser use. Opus 5.5 ya da Sonnet 5.5 altında dar görevli coding subagent olarak da çalışabiliyor. Ayarlanabilir effort seçeneği taşıyan ilk Haiku bu. Aynı gün Sonnet 5.5’in cache read fiyatı da yarıya, milyon token başına $0,10’a indi. Anthropic’e göre bu, çoğu agentic işte Sonnet’i yüzde 20 kadar ucuzlatıyor.

Anthropic’in kendi benchmark tablosuna göre Haiku 5.5, OSWorld 2.1 offline alt kümesinde yüzde 72,4 almış. Luna yüzde 48,9, Sonnet 5.5 yüzde 83,9’da. Terminal-Bench 4.0’da aynı sırayla yüzde 39,2, 16,4 ve 70,6. Şirket, zor agentic coding işlerinde Sonnet ve Opus’un daha iyi seçenek olmaya devam ettiğini kendisi söylüyor.

Benim çıkaracağım kullanım kuralı açık: Subagent promptlarını kısa tutun. Özet, arama ve context compaction çağrılarının maliyeti ciddi biçimde düştü. 100K çizgisini geçince fatura beş katına çıkıyor.

🧩 GPT-6 yanıtla birlikte arayüz de üretiyor

GPT-6, 7 Ekim’de ChatGPT’ye açılmaya başladı. Plus, Pro, Business ve Enterprise kullanıcıları Chat bölümünde GPT-6 Sol’u kullanıyor. Free ve Go hesaplarında GPT-6 Luna’nın dağıtımı bugün başlıyor. Work ve Codex modellerinde değişiklik yok.

Yeni Intelligent UI, düz metnin yanına görsel, buton, form, grafik ve küçük araçlar yerleştiriyor. Bu bileşenler model yanıt üretirken ekrana akıyor. OpenAI’ın örnekleri arasında hesap bölüştürücü, emeklilik hesabı, retro oyun ve harita üstünde rota var. Görselleri azaltmak mümkün. Şirket, modelin tasarım kararlarında daha yapacak işi olduğunu da kabul ediyor.

ChatGPT artık düşünmeyi bitirmeden yazmaya başlayabiliyor. OpenAI’a göre web araması gereken sorularda GPT-6 Instant, GPT-5.6 Instant’tan ortalama yüzde 44 daha erken yanıt vermeye başlıyor. Rakam şirketin kendi ölçümü. Güvenlik tarafında da OpenAI, Astra çalışmalarından yararlandığını ve çok turlu jailbreak denemelerine karşı direncin arttığını söylüyor.

Türkiye’de pek çok kişi için ChatGPT demek ücretsiz sürüm demek. Dolayısıyla model neslinin değişmesi önemli. O anda üretilen hesap araçları kullanışlı olabilir, ancak para hesabında çıkan her rakamı ayrıca kontrol ederim. Sol ve Luna’nın ayrıntıları için önceki GPT-6 incelemesine bakabilirsiniz.

💻 Microsoft yerel ajanları sandbox içine alıyor

Gümüş renkli sıradan bir dizüstü bilgisayardan yükselen saydam cam küp.
Windows 11’de genel kullanıma açılan MXC (Microsoft Execution Containers) ile kurumlar bir agent’ın hangi dosyalara ve ağlara erişebileceğini belirliyor, kural çalışma anında uygulanıyor.

Microsoft, “hybrid intelligence” yaklaşımında uygun işleri yerel makinede çalıştırıp gerektiğinde buluta gitmeyi öneriyor. Bunun donanımı Surface Laptop Ultra. NVIDIA RTX Spark, 128 GB’a kadar unified memory ve bir petaflopa kadar AI işlem gücü sunan cihaz $2.599’dan başlıyor, teslimatlar 16 Ekim’de başlayacak.

MAI Code 1.1 Flash toplam 137B, aktif 6,8B parametreli bir MoE model. Yaklaşık üç bite quantize edilmiş ve yerelde 256K context çalıştırabiliyor. Microsoft’un kendi Surface testinde 256K context’te bellek kullanımı en fazla 75,5 GB’a çıktı. Prompt işleme hızı 64K’da saniyede 923,5 token, 128K’da 769,8 token ölçülmüş. Yerel model çağrılarında inference ücreti alınmadığını da şirket söylüyor.

75,5 GB, işin gerçek boyutunu gösteriyor. Bu, parasını baştan verdiğiniz özel bir geliştirici cihazı. Daha geniş kitleyi ilgilendiren yenilik MXC olabilir. Windows 11’de genel kullanıma açılan Microsoft Execution Containers, ajanın erişebileceği dosya ve ağları kurumun belirlemesini, bu sınırların çalışma anında uygulanmasını sağlıyor. Açık kaynak olan MXC farklı işletim sistemlerinde de çalışıyor.

MXC’ye bugün destek verenler arasında Codex, GitHub Copilot, Replit ve LM Studio var. Claude Code ise desteği yakında gelecekler arasında. Yerel ajanların güven vermesi için erişim sınırı şart. Windows tarafındaki bu çözüm, Apple Full Disk Access ve AI ajanları yazısında gördüğümüz izin kavgasının bir başka cevabı.

🔍 SynthID Detector herkese açıldı

Google, SynthID Detector’ı synthid.com adresinde dünya çapında kullanıma açtı. İngilizce arayüz, görsel, video ve ses dosyalarında Google ile ortakları OpenAI, NVIDIA ve Kakao’nun SynthID filigranını arıyor. Apple desteği yakında gelecek.

Google’ın verdiği sayılar epey büyük: 2023’ten bu yana 180 milyardan fazla görsel ve video ile 240 bin yıllık ses filigranlanmış. Search, Gemini ve Chrome içindeki doğrulama sistemi günde bir milyondan fazla istek alıyor.

Herkese açık sürümün kapsamı daha dar. Ars Technica’nın aktardığına göre giriş yapmak gerekiyor, günlük yaklaşık 10 kontrol hakkı var, kurum içi araçtaki gibi işaretli bölgeleri gösterme özelliği sitede yok. Microsoft ve Meta kendi filigran standartlarını kullanıyor. Bu araçlar da hatasız değil.

“SynthID bulunamadı” yanıtını, içeriği insan üretti diye okumam. Söylediği tek şey filigranın bulunamadığı. Yine de viral bir videoyu inceleyen gazeteci için birkaç şirketin izini tek yerde aramak faydalı. Günde 10 hakla haber merkezi altyapısı olmaz, ara sıra yapılacak kontrol için iş görür.

🧯 İşten çıkarılan araştırmacılar görünür muhakeme istiyor

OpenAI’ın geçen hafta işten çıkardığı Tomek Korbak, Mikita Balesni ve Jasmine Wang, yönetim kuruluna ve güvenlik komitelerine mektup gönderdi. Wall Street Journal’ın aktardığı mektup, modelin izlenebilirliğini daha da azaltacak adımlardan kaçınılmasını, bağımsız denetçileri ve açık bir güvenlik ekosistemini öneriyor.

Üç araştırmacıya göre işten çıkarmalar, OpenAI’da kalanlar üzerinde caydırıcı bir etki yaratıyor. OpenAI geçen hafta yollarını ayırma gerekçesini hassas şirket bilgilerine erişim ve bunların kullanımıyla ilgili kuralların ihlali olarak açıklamıştı. Şimdi de kararın “güvenlik kaygılarını dile getirmek ya da konuşmakla ilgisi olmadığını” söylüyor. Şirket içi bir yazıda ise önerilere “güçlü biçimde” katıldıklarını yazmışlar. Konunun somut bir karşılığı da var: Gizmodo’nun hatırlattığı GPT-6 Astra system card’ına göre Astra sınıfı modeller, adversarial koşullarda OpenAI’ın CoT izleyicilerinden kaçabilir. Astra sonrası safety case çıtası da aynı izleme sorununa dayanıyordu. Madem taraflar içerikte anlaşıyor, bunu sonraki system card içinde açık bir taahhüt olarak görmek isterim.

Çarşamba, ürün duyurusu kılığına girmiş bir fiyat günüydü. Küçük model çağrıları on sente indi, ücretsiz ChatGPT GPT-6’ya geçti, Microsoft da donanımın parasını peşin ödeyebilene token sayacı olmayan bir seçenek sundu. Modelin düşüncesini görebilecek miyiz, sahte videoyu ayırt edebilecek miyiz soruları da biraz ilerledi. Şimdilik o kadarıyla yetiniyorum.

Oğuzhan Koçaklı

2015 yılından beri profesyonel olarak marketing, gaming ve blockchain dünyasıyla ilgileniyorum. Bir çok önemli markanın pazarlama stratejilerinin oluşturulması ve uygulanmasında görev aldım. Şimdilerde mobil oyunlar ve oyunların blockchain entegrasyonu üzerine çalışmalar yürütüyorum. Yapay zeka çalışmaları ise uzun yıllardır hobim.

Tüm yazıları

Bir yanıt yazın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir