Modeller

Anthropic Opus 5'i Duyurdu: Aynı Fiyat, İki Katı Performans

Anthropic 24 Temmuz'da Claude Opus 5'i yayınladı. Fiyat Opus 4.8 ile aynı kaldı, performans birçok testte iki katına çıktı. Kurumsal kullanıcıyı ilgilendiren asıl detay ise veri saklama satırında.

Faruk Talmaç25 Temmuz 20263 dakika7 görüntülenme
Anthropic Opus 5'i Duyurdu: Aynı Fiyat, İki Katı Performans

Milyon çıktı token'ı için 25 dolar, milyon girdi token'ı için 5 dolar. Anthropic'in 24 Temmuz'da yayınladığı Claude Opus 5'in fiyat etiketi, iki ay önce çıkan Opus 4.8 ile kuruşu kuruşuna aynı. Değişen şey fiyat değil, aynı paraya ne aldığınız.

Şirketin kendi ölçümlerine göre Opus 5, Frontier-Bench v0.1 testinde Opus 4.8'in performansını iki katından fazla geçiyor, üstelik görev başına maliyeti daha düşük. Model; Claude uygulaması, API, Claude Code ve Claude Cowork tarafında aynı anda erişime açıldı.

Rakamlar ne söylüyor?

Anthropic'in paylaştığı karşılaştırmalar, Opus 5'i kendi üst segmentindeki Fable 5 ile aynı cümlede kullanmaya odaklanmış durumda. Öne çıkan başlıklar şöyle:

  • CursorBench 3.2: Fable 5'in en yüksek skoruna yüzde 0,5 farkla yaklaşıyor, ama görev başına maliyet yarısı kadar.
  • OSWorld 2.0: Fable 5'in en iyi sonucunu geçiyor, maliyetin üçte biri biraz üzerinde.
  • ARC-AGI 3: kendisine en yakın modelin üç katı skor.
  • Zapier AutomationBench: en yakın rakibin yaklaşık 1,5 katı başarı oranı.

Bu tablonun tek bir okuması var: Anthropic bu sürümde "daha zeki bir model" değil, "benzer zekayı belirgin şekilde ucuza veren bir model" satıyor. Sınır performansta yarış yavaşlarken rekabetin fiyat/performans oranına kaydığı yönündeki tez, bu duyuruyla biraz daha ağırlık kazandı.

Uzun süreli ajanlar için gelen ayarlar

Opus 5 ile birlikte gelen özelliklerin çoğu tek soruluk sohbetler için değil, saatlerce çalışan otomasyonlar için tasarlanmış:

  • Effort (çaba) ayarı: modelin ne kadar "düşüneceğini" düşük, orta ve yüksek olarak siz belirliyorsunuz. Zeka ile maliyet arasındaki dengeyi işin ağırlığına göre kurabiliyorsunuz.
  • Fast mode: varsayılanın yaklaşık 2,5 katı hız, karşılığında iki katı fiyat.
  • Sohbet ortasında araç değiştirme ve otomatik yedek yönlendirme, ikisi de beta aşamasında. İkincisinde güvenlik filtresi devreye girdiğinde işlem hataya düşmek yerine daha hafif bir modele yönleniyor.
  • Veri saklama zorunluluğu yok: kurumsal alıcı için bu satır, benchmark tablosunun tamamından daha belirleyici olabilir.

Güvenlik tarafında Anthropic, Opus 5'i bugüne kadarki en hizalı modeli olarak tanımlıyor ve aldatıcı davranış oranının en düşük seviyede olduğunu söylüyor. Siber güvenlik sınıflandırıcılarının Fable 5'e kıyasla yaklaşık yüzde 85 daha az devreye girdiğini de ekliyor, yani meşru güvenlik çalışması yapan ekipler daha az yanlış alarmla uğraşacak. Buna karşılık şirket, biyoloji araştırması ve saldırgan siber güvenlik alanlarında Mythos 5'in hâlâ önde olduğunu açıkça belirtiyor.

Türkiye'den bakınca ne değişiyor?

Döviz kurunun sıkıştırdığı bir bütçeyle yapay zeka entegrasyonu planlayan şirketler için buradaki asıl haber benchmark skorları değil, birim maliyet. Aynı işi yarı fiyata yaptırabilmek, altı ay önce "bizim ölçeğimize göre pahalı" diye rafa kaldırılmış projeleri tekrar masaya getirebilir.

Sahada sık gördüğümüz bir refleksi de not edelim: pek çok ekip model seçerken otomatik olarak listenin en üstündekini işaretliyor. Oysa müşteri destek yanıtı üreten bir akışla 40 sayfalık sözleşmeyi analiz eden bir akış aynı modeli hak etmiyor. Opus 5'in çaba ayarı tam bu yüzden fiyat indiriminden daha değerli: doğru kurgulandığında tek bir sistemin içinde iş bazında maliyet yönetmenizi sağlıyor. Yapay zeka entegrasyonu projelerinde ilk optimizasyon kalemi neredeyse her zaman burası oluyor.

Kaynaklar: Anthropic, TechCrunch, the-decoder

Bu Yazıyı Paylaş

Faruk Talmaç

Yazan

Faruk Talmaç

Kurucu Ortak & Editör

Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucu ortağı.

Diğer haberler

Bu teknolojiyi işinizde kullanmak ister misiniz?

Konuşalım