Şirketler

OpenAI %80 İndirim Yaptı, DeepSeek Bir Gün Sonra Cevap Verdi

GPT-5.6 Luna'nın fiyatı %80 düştü; 24 saat sonra DeepSeek, Luna'nın 1 puan gerisinde ama görev başına %60 daha ucuz V4 Flash 0731'i yayınladı. Fiyat savaşı hacim segmentinde kızışıyor.

Faruk Talmaç31 Temmuz 20263 dakika5 görüntülenme
OpenAI %80 İndirim Yaptı, DeepSeek Bir Gün Sonra Cevap Verdi

Milyon token başına 0,20 dolar. OpenAI'ın en küçük modeli GPT-5.6 Luna'nın 30 Temmuz'dan itibaren geçerli yeni girdi fiyatı bu; bir gün öncesine kadar tam beş katıydı. Çıktı tarafında da tablo aynı: 1,20 dolara inen fiyat, yüzde 80'lik bir indirime karşılık geliyor. İndirim şimdilik ailenin en ucuz üyesi olan Luna ile sınırlı.

OpenAI indirimi rekabetle değil verimlilikle açıklıyor: şirkete göre GPT-5.6 Sol kendi GPU yazılımını optimize ederek sunum maliyetini yüzde 20 düşürdü, spekülatif kod çözme (speculative decoding) ise token üretim hızını yüzde 15'ten fazla artırdı. Teknik gerekçe muhtemelen doğru. Ama zamanlama, ikinci bir okumayı kaçınılmaz kılıyor: düşük maliyetli Çinli sağlayıcıların hacim segmentindeki fiyat baskısı giderek sertleşiyor.

Kaldı ki bu yalnızca iki şirketin düellosu değil. Microsoft aynı günlerde sınır modelleri kovalamak yerine ucuz uzman modellere ağırlık vereceğini anlatıyordu. Pazarın hacim tarafında üç büyük oyuncu artık aynı cümleyi kuruyor: yeterince iyi modeli, mümkün olan en düşük fiyata sunmak.

DeepSeek'in cevabı 24 saat içinde geldi

31 Temmuz'da DeepSeek, bütçe modeli V4 Flash'ın "0731" sürümünü yayınladı. Rakamlar iddialı: model, Artificial Analysis zeka endeksinde 50 puana ulaşarak bir önceki sürümün 10 puan üzerine çıktı ve Luna'nın yalnızca 1 puan gerisinde kaldı. Gerçek ofis işlerini ölçen GDPval testinde 1.189'dan 1.559 Elo puanına sıçradı. Üstelik aynı işleri öncekinden yüzde 12 daha az token harcayarak bitiriyor.

Fiyat kıyası, OpenAI açısından tablonun rahatsız edici kısmı: DeepSeek'in görev başına maliyeti, yüzde 80'lik indirim sonrasında bile Luna'nın yaklaşık yüzde 60 altında. Bunda yüzde 98'e çıkan önbellek indiriminin payı büyük; sektör standardı yüzde 90 civarında. Önbellek indirimi pratikte şu demek: modele her istekte yeniden gönderdiğiniz sabit talimatlar ve dokümanlar, ikinci istekten itibaren neredeyse bedavaya işleniyor. Chatbot ve ajan senaryolarında faturanın büyük kısmı tam da bu tekrarlardan oluştuğu için, kağıt üzerindeki fiyat farkı gerçek kullanımda daha da açılıyor. Model ağırlıkları da MIT lisansıyla Hugging Face'te yayınlandı: 284 milyar toplam, 13 milyar aktif parametre ve 1 milyon token'lık bağlam penceresi.

API faturanız için ne anlama geliyor?

İki hamlenin bileşik sonucu şu: yüksek hacimli, görece basit yapay zeka işlerinin (metin sınıflandırma, özetleme, destek hattı chatbot'u) birim maliyeti bir yıl içinde kat kat düştü. Türkiye'den dolarla API faturası ödeyen işletmeler için bu, dün "maliyeti karşılamaz" denilen otomasyon senaryolarının bugün yeniden hesaplanmaya değer olduğu anlamına geliyor.

Sahada sık gördüğümüz hata, altı ay önce yapılmış bir fiyat/performans karşılaştırmasının hâlâ geçerli sayılması. Bu haftanın gösterdiği gibi tablo 24 saatte değişebiliyor. Önerimiz: model seçimini koda gömmeyin, sağlayıcıyı tek konfigürasyon değişikliğiyle değiştirebileceğiniz bir katman kurun ve fiyat listelerini takvimle değil, büyük duyuru haftalarıyla birlikte gözden geçirin. Bir de küçük bir uyarı: bu keskinlikte bir rekabette kimse yüzde 80'i keyfinden indirmez; ucuzlayan segmentte kalite ve limit koşullarını sözleşmede netleştirin.

Kaynaklar: The Decoder (OpenAI), The Decoder (DeepSeek)

Bu Yazıyı Paylaş

Faruk Talmaç

Yazan

Faruk Talmaç

Kurucu Ortak & Editör

Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucu ortağı.

Diğer haberler

Bu teknolojiyi işinizde kullanmak ister misiniz?

Konuşalım