10 sent. Anthropic'in 7 Ekim'de yayına aldığı Claude Haiku 5.5, 100 bin token'a kadar olan isteklerde milyon girdi token'ı başına bu fiyatı istiyor. Çıktı tarafı 50 sent. Bir önceki küçük model Haiku 4.5'in etiketi 1 dolar ve 5 dolardı. Yani kağıt üzerinde girdi 10 kat, çıktı 10 kat ucuzladı; Anthropic kendi hesabında ortalama yüzde 75 tasarruf diyor. Aradaki fark, yeni modelin daha fazla token harcamasından geliyor, aşağıda açıklıyoruz.
Fiyat listesi iki kademeli
Haiku 5.5'in fiyatı isteğin uzunluğuna göre değişiyor. 100 bin token'ın altındaki istemlerde girdi 0,10 dolar, çıktı 0,50 dolar, önbellekten okuma 0,01 dolar. 100 bin token'ı aşan istemlerde fiyat beş katına çıkıyor: 0,50 dolar girdi, 2,50 dolar çıktı. Toplu işlem (Batch) API'si bu rakamları yarıya indiriyor; bu bilgi Anthropic'in dokümanlarına dayanan üçüncü taraf bir kaynaktan geliyor, model sayfasında yer almıyor.
Yüzde 75 rakamının altında bir dipnot var. Haiku 5.5, Opus 4.7 ile gelen yeni ayrıştırıcıyı (tokenizer, metni modelin işlediği parçalara bölen bileşen) kullanıyor ve aynı metin için yaklaşık yüzde 30 daha fazla token üretiyor. Anthropic bunu hesaba katarak kısa isteklerde yüzde 90, uzun isteklerde yüzde 50 tasarruf öngörüyor. Bağımsız bir hesap ise aynı varsayımlarla yüzde 87 ve yüzde 35 buluyor. İki hesap da aynı yöne işaret ediyor: kısa istek yapan uygulamalar kazanıyor, uzun belge besleyenler daha az kazanıyor.
Aynı gün Sonnet 5.5'in önbellekten okuma fiyatı 0,20 dolardan 0,10 dolara indi. Anthropic'e göre bu, ajan tipi iş yüklerinin çoğunda yüzde 20 civarı ucuzlama demek.
Kıyas tablosunda nereye oturuyor?
Anthropic'in paylaştığı rakamlar, sırayla Haiku 5.5, Haiku 4.5, GPT-6 Luna ve Sonnet 5.5 için:
- Terminal-Bench 4.0 (komut satırında ajan görevleri): yüzde 39,2 / 0,0 / 16,4 / 70,6
- OSWorld 2.1 (bilgisayar kullanımı, çevrimdışı alt küme): yüzde 72,4 / 15,7 / 48,9 / 83,9
- GDPval-AA v2.1 (iş görevleri, Elo): 1620 / 735 / 1437 / 1840
- Humanity's Last Exam, araçsız: yüzde 45,9 / 10,2 / veri yok / 56,9
Rakamlar Anthropic'in kendi ölçümü; bağımsız değerlendirme henüz yayınlanmadı. Yine de tablo iki şeyi gösteriyor. Haiku 4.5 ile Haiku 5.5 arasındaki fark bir kuşak sıçraması; Haiku 4.5'in sıfır aldığı terminal testinde yeni model yüzde 39'a çıkıyor. Öte yandan Sonnet 5.5 ile arasındaki açık, özellikle kodlama ve uzun ajan görevlerinde, hâlâ geniş. Anthropic de bunu kabul ediyor: karmaşık kodlama işleri için Sonnet 5.5 ve Opus 5.5'i öneriyor, Haiku'yu özetleme, bağlam sıkıştırma, alt ajan görevleri, canlı müşteri desteği ve tarayıcı kullanımı için konumlandırıyor.
Bu, efor ayarı (Low, Medium, High, Xhigh, Max) sunan ilk Haiku. Hız tarafında Anthropic standart hızda en hızlı modeli diyor; Box, erken testlerde Haiku 4.5'in yarısı gecikme ölçtüğünü, Asana ise görev tamamlamada yüzde 30'un üzerinde gecikme düşüşü gördüğünü aktarıyor. İki müşteri alıntısı da Anthropic'in sayfasından, yani seçilmiş örnekler.
Model Claude API'de, AWS, Google Cloud ve Microsoft Azure üzerinde hemen kullanılabiliyor. Bağlam penceresi büyüklüğü duyuru sayfasında belirtilmemiş; claude.ai aboneliklerinde hangi planda açılacağı da yazmıyor.
Türkiye'deki bir işletme için hesap
Küçük modelin fiyatı, yapay zekayı "her mesajda çalışan" bir bileşene dönüştüren eşik. Ayda 20 milyon girdi ve 4 milyon çıktı token'ı harcayan bir müşteri destek asistanı düşünün; bu, günde birkaç yüz görüşme demek. Haiku 4.5 ile aylık fatura 40 dolardı. Haiku 5.5 ile aynı yük, yüzde 30 fazla token varsayımıyla bile 5 dolar civarına iniyor. Bu ölçekte fiyat artık bir karar kriteri olmaktan çıkıyor; kriter doğruluk oluyor.
Bizim önerimiz iki adımlı. Önce elinizdeki sınıflandırma, özetleme ve yönlendirme işlerini Haiku 5.5'e taşıyıp kendi test setinizle doğruluğu ölçün; bu tür görevlerde Sonnet seviyesi model çoğu zaman gereksiz masraf. Karmaşık, çok adımlı işleri ise Sonnet 5.5'te tutun ve Haiku'yu onun yanında alt görevleri üstlenen yardımcı olarak kullanın. Kıyas tablosundaki rakamlar yol gösterici, ama kendi verinizde ölçmeden geçiş yapmayın.
Kaynaklar: Anthropic, Claude Haiku 5.5 duyurusu, The Daily Brief, fiyat ve geçiş analizi




