Modeller

Grok 4.6, GPT-5.6 Sol'u Yakaladı: Fiyatı %60 Daha Ucuz

SpaceXAI'ın yeni modeli Grok 4.6, zeka endeksinde GPT-5.6 Sol ile eşitlendi ama token fiyatı %60'tan fazla düşük. Ajan görevlerini de yarı adımda bitiriyor.

Muhammet Fatih Batman13 Ağustos 20263 dakika5 görüntülenme
Grok 4.6, GPT-5.6 Sol'u Yakaladı: Fiyatı %60 Daha Ucuz

2 dolar giriş, 6 dolar çıkış. Grok 4.6'nın milyon token başına fiyatı bu. Aynı endekste eşit puan aldığı GPT-5.6 Sol'un fiyatı 5 dolar ve 30 dolar. Yani neredeyse aynı işi yapan iki modelden biri, çıktı tarafında beş kat pahalı.

SpaceXAI, Grok 4.6'yı 12 Ağustos'ta yayınladı. Şirket, Elon Musk'ın yapay zeka girişimi xAI'ın Şubat 2026'da SpaceX ile birleşmesinin ardından bu isimle anılıyor.

Endeks tablosunda nerede duruyor?

Bağımsız ölçüm kuruluşu Artificial Analysis'in zeka endeksinde Grok 4.6, 61 puanla GPT-5.6 Sol ile başa baş. Önceki sürümü Grok 4.5'e göre 5 puanlık bir sıçrama söz konusu.

Tablonun tepesi hâlâ Anthropic'te: Claude Opus 5 63 puan, Fable 5 62 puan. Aradaki fark bir iki puan, yani bugün ilk beşteki modeller ham yetenek açısından birbirine oldukça yakın. Rekabet artık puan tablosunda değil, o puanın kaça mal olduğunda yaşanıyor.

Asıl fark adım sayısında

Ajan görevlerini ölçen GDPval-AA v2 testinde Grok 4.6, 1.753 Elo puanıyla ikinci sırada. Ama buradaki ilginç ayrıntı sıralama değil, verimlilik: model karmaşık bir görevi ortalama 53 adımda tamamlıyor. Claude Opus 5 aynı işi yaklaşık 103 adımda bitiriyor.

Bu ayrıntı fatura açısından önemli. Ajan mimarilerinde her adım yeni bir model çağrısı demek, yani ödediğiniz tutar adım sayısıyla doğrudan çarpılıyor. Token başına ucuz olan bir model, işi yarı adımda bitiriyorsa toplam maliyette fark tahmin edilenden daha da açılıyor.

Fiyat farkı aylık faturada ne demek?

Somut bir örnekle bakalım. Orta ölçekli bir müşteri destek botunun ayda 10 milyon giriş, 2 milyon çıkış token'ı harcadığını varsayalım. Bu kullanımda aylık maliyet şöyle çıkıyor:

  • Grok 4.6: yaklaşık 32 dolar
  • Claude Opus 5: yaklaşık 100 dolar
  • GPT-5.6 Sol: yaklaşık 110 dolar

Küçük hacimlerde bu rakamlar önemsiz görünüyor. Ama aynı botu on farklı süreçte çalıştırdığınızda ya da belge işleme gibi token yiyen bir işe soktuğunuzda fark yıllık bazda ciddi bir kaleme dönüşüyor.

Model API üzerinden, Cursor'da, Grok Build'de ve OpenRouter, Vercel, Cloudflare gibi platformlar üzerinden erişilebiliyor.

Ucuz olan her zaman doğru seçim mi?

Hayır, ve bunu net söylemek gerekiyor. Fiyat tablosuna bakıp model değiştirmek, sahada gördüğümüz en yaygın yanlış kararlardan biri.

Bir modelin sizin işinizdeki performansı endeks puanıyla değil, sizin verinizle ölçülür. Türkçe ağırlıklı bir destek akışında, sektörünüze özgü terminolojide veya kendi belgelerinizle çalışan bir sistemde sıralama tamamen değişebiliyor. Genel testlerde önde olan bir model, sizin müşteri e-postalarınızda ikinci sırada kalabilir.

İkinci mesele veri politikası. Fiyat karşılaştırması yaparken sorulacak soru sadece kaç dolar olduğu değil, verinin nerede işlendiği ve eğitim için kullanılıp kullanılmadığı. KVKK kapsamındaki bir veriyi ucuz diye taşıdığınız yer, tasarrufun tamamını riske çevirebilir.

Bizim müşterilerimize önerdiğimiz yöntem şu: kendi gerçek verinizden 50 ile 100 örnek seçin, aynı istemi üç modele birden verin, sonuçları yan yana koyup puanlayın. Bu test bir günde biter ve endeks tablolarından çok daha güvenilir bir cevap verir. Fiyat farkı ise ancak bu testten sonra anlamlı bir kriter haline gelir.

Bu haftanın asıl haberi Grok 4.6'nın kendisi değil belki de: sınır modeller arasındaki yetenek farkı kapanırken, fiyat farkı açılıyor. Bu, sağlayıcı değiştirmeyi kolaylaştıracak bir mimari kurmuş olan ekiplerin lehine bir gelişme.

Kaynaklar: The Decoder, Artificial Analysis

Bu Yazıyı Paylaş

Muhammet Fatih Batman

Yazan

Muhammet Fatih Batman

Kurucu & Editör

Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucusu.

Diğer haberler

Bu teknolojiyi işinizde kullanmak ister misiniz?

Konuşalım