Modeller

Anthropic Claude Fable 5.1'i Duyurdu: Aynı Fiyat, Yüzde 25 Ucuz İş

Anthropic'in yeni amiral modeli Fable 5.1 liste fiyatını korudu ama önbellek okumasını yüzde 75 ucuzlattı. Aynı modelin kısıtsız sürümü Mythos 5.1 ise sadece onaylı kuruluşlara açık.

Faruk Talmaç2 Eylül 20263 dakika3 görüntülenme
Anthropic Claude Fable 5.1'i Duyurdu: Aynı Fiyat, Yüzde 25 Ucuz İş

Milyon token başına 10 dolar giriş, 50 dolar çıkış. Anthropic'in 1 Eylül'de yayımladığı Claude Fable 5.1'in liste fiyatı, bir önceki Fable 5 ile kuruşu kuruşuna aynı. Değişen tek kalem önbellek okuması (cache read): milyon token başına 1 dolardan 0,25 dolara indi, yani yüzde 75 kesinti. Şirketin hesabına göre bu tek değişiklik tipik bir iş yükünü yaklaşık yüzde 25, uzun süre aynı bağlamı tekrar tekrar okuyan ajan (agent) işlerini ise yüzde 45'e kadar ucuzlatıyor.

Duyurunun ikinci yarısı daha ilginç. Anthropic, Fable 5.1 ile birlikte Claude Mythos 5.1 adında ikinci bir model daha açıkladı ve iki model için şu cümleyi kullandı: "Aynı model, farklı düzeyde güvenlik önlemleri." Yani ağırlıklar aynı; fark, modelin hangi istekleri geri çevirdiğinde.

Rakamlar: Fable 5'ten Fable 5.1'e ne kadar fark var?

Anthropic'in kendi tablosundaki beş kıyaslamada en büyük sıçrama bilimsel araştırma ajanlığında: Terminal-Bench-Science testinde Fable 5 yüzde 24,7 alırken Fable 5.1 yüzde 52,6'ya çıkmış, yani iki katından fazla. Ajan tabanlı kodlama (Terminal-Bench 4.0) yüzde 42'den yüzde 55,8'e, bilgisayar kullanımı (OSWorld 2.0) yüzde 72,9'dan yüzde 77,9'a yükselmiş. Kodlama (CursorBench) ve çok disiplinli akıl yürütme (Humanity's Last Exam) testlerindeki artış ise 1-3 puanla sınırlı.

Bu dağılım bir şey söylüyor: sıçrama tek soruya cevap veren "sohbet" kullanımında değil, saatlerce süren ve ara adımları kendi planlayan görevlerde. Anthropic'in öne çıkardığı örnekler de buna uygun: rakip modellerden 10 kat daha güçlü bağlanan protein tasarımları, Venüs yüzeyinin çözünürlüğü 10-20 kilometreden 2-3 kilometreye indirilmiş yükseklik haritası, hesaplamalı biyoloji modellerinde yüzde 30-60 GPU maliyet düşüşü.

Bağımsız geliştirici Simon Willison'ın ilk gün notlarında ise dikkat çeken başka bir sayı var. Model beş düşünme seviyesiyle geliyor (low, medium, high, xhigh, max) ve düşünmeyi tamamen kapatma seçeneği artık yok. Aynı istek "low" seviyede yaklaşık 2.000 çıktı tokeni ve 10 sent tutarken "max" seviyede 66.000 token ve 3,30 dolara çıkıyor. 33 katlık bu makas, faturayı modelin fiyatından çok kullanım ayarının belirleyeceğini gösteriyor.

Mythos 5.1'e kim erişebiliyor?

Fable 5.1 herkese açık: Claude.ai, Claude Code, Claude Enterprise ve üç büyük bulut (AWS, Google Cloud, Microsoft Azure). API'de model kimliği claude-fable-5-1. Mythos 5.1 ise şimdilik yalnızca ABD'deki kuruluşlara, iki "güvenilir erişim" programı üzerinden açılıyor: savunma amaçlı siber güvenlik işleri için Siber Doğrulama Programı ve ABD hükümetiyle ortak yürütülen Yaşam Bilimleri Doğrulama Programı.

Güvenlik katmanında da ölçülebilir değişiklikler var. Anthropic, siber güvenlik bağlamındaki yanlış reddetmelerin yüzde 60 azaldığını, biyoloji filtrelerinin zararsız tıp ve temel biyoloji sorularında yüzde 85 daha az devreye girdiğini söylüyor. Zafiyet keşfi artık savunma amaçlıysa serbest. Modelin çıktılarına, AB Yapay Zeka Yasası'nın şeffaflık şartına uygun, gözle görülmeyen bir metin filigranı (watermark) ekleniyor. Ayrıca API üzerinden model damıtmayı (distillation) zorlaştıran mekanizmalar eklenmiş.

Türkiye'deki ekipler için maliyet hesabı

Bizim okumamız: bu sürümün asıl haberi kıyaslama tablosu değil, önbellek fiyatı. Türkiye'de Claude API'sini üretimde kullanan ekiplerin çoğu ya müşteri hizmetleri botu ya da belge işleme hattı çalıştırıyor. Her iki senaryoda da istem (prompt) büyük ölçüde sabittir: sistem talimatı, şirket bilgi tabanı, örnek diyaloglar. Bu sabit kısım her çağrıda önbellekten okunur. Önbellek okuması yüzde 75 ucuzlayınca aylık fatura, tek satır kod değiştirmeden düşer.

Somut bir ölçek: ayda 200 bin çağrı yapan, her çağrıda 8 bin tokenlik sabit bağlam okuyan bir destek botu düşünün. Bu, ayda 1,6 milyar önbellek tokeni demek. Eski fiyatla 1.600 dolar, yeni fiyatla 400 dolar. Fark, dolar bazlı sözleşmelerle çalışan Türk yazılım ekipleri için ayda yaklaşık 50 bin TL.

Buna karşılık iki uyarı. Birincisi, düşünme seviyesi ayarını varsayılan "high"da bırakıp uzun görevler koşturan bir ekip, çıktı tokeninde önbellek indirimini fazlasıyla geri verebilir; seviye seçimi artık bir maliyet kararı. İkincisi, Mythos 5.1'e erişim ABD'li kuruluşlarla sınırlı; Türkiye'den bir siber güvenlik firmasının şu an başvurabileceği bir kanal görünmüyor. Kısıtsız model ihtiyacı olan ekiplerin bunu planlamaya katması gerekir.

Kaynaklar: Anthropic duyurusu, Simon Willison, TechCrunch

Bu Yazıyı Paylaş

Faruk Talmaç

Yazan

Faruk Talmaç

Kurucu Ortak & Editör

Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucu ortağı.

Diğer haberler

Bu teknolojiyi işinizde kullanmak ister misiniz?

Konuşalım