Modeller
GPT-6 Astra Yayında: Fiyatı, Limitleri ve Rakamları
GPT-6 Astra ChatGPT Pro ve Enterprise'da açıldı, API'de milyon token 10/50 dolar. Mesaj hakları Sol'un yarısı; benchmark tablosu karışık, bazı sayılar gün içinde değişti.

10 dolar giriş, 50 dolar çıkış. OpenAI'ın 3 Eylül'de duyurduğu GPT-6 Astra'nın milyon token başına API fiyatı bu ve önceki model GPT-5.6 Sol'un güncel kampanyalı fiyatının 2,5 katına denk geliyor. Bağlam penceresi 1 milyon token, tek seferde üretebildiği çıktı 128 bin token. Önbellekten okunan girdi 1 dolar. Model API'de gpt-6-astra adıyla, ayrıca Microsoft Azure ve Amazon Bedrock üzerinden sunuluyor.
Biz Astra'yı 2 Eylül'de OpenAI'ın kendi risk çerçevesinde "kritik" siber eşiği geçen ilk model olarak yazmıştık; o yazı ön duyuruya dayanıyordu. Bu haber lansmanın kendisiyle ilgili: kim, ne zaman, kaç mesaj, hangi rakamlarla.
Kim erişiyor, kaç mesajla?
The Decoder'ın 5 Eylül tarihli derlemesine göre Astra şu an ChatGPT Pro, Enterprise ve Business Premium planlarında açık; Plus ve Business Standard kullanıcılarına "önümüzdeki günlerde" geliyor. Ücretsiz ve Go katmanları kapsam dışı. Mesaj hakları Sol'un yaklaşık yarısı: Plus'ta 5 ile 45 arası (Sol'da 10 ile 100 arası), 200 dolarlık Pro planında haftada 200 Astra Pro mesajı, 100 dolarlık Pro ve Business Premium'da haftada 50, Business Standard'da ayda 15. Kurumsal yöneticiler modeli varsayılan olarak kapatabiliyor.
Rakamlar neyi gösteriyor, neyi göstermiyor?
OpenAI'ın kendi tablosunda öne çıkan farklar bilgisayar kullanımı ve matematikte. OSWorld 2.0'da yüzde 72,6 (Sol yüzde 65,7), görev başına süre yaklaşık yüzde 47 daha kısa. FrontierMath 4. seviyede yüzde 97,6. ARC Prize'ın bağımsız ölçümünde ARC-AGI-3 yarı özel setinde sağlayıcı adaptörüyle yüzde 99,9 (maliyet 18.817 dolar); standart düzenekte ise yüzde 62,7. Aynı testte model, seviyelerin yüzde 96'sında insan taban çizgisinden daha az hamle kullandı.
Tabloyu tersinden okuyunca resim değişiyor. Artificial Analysis'in genel zekâ endeksinde Claude Fable 5.1 65,7 puanla Astra'nın (61,2) önünde. Humanity's Last Exam'de Astra yüzde 57,2 ile Fable 5.1'in (yüzde 65,0) gerisinde; bu satır lansman yazısında öne çıkarılmadı. Kodlamada Terminal-Bench 4.0 farkı iki puan (57,7'ye 55,8). Yani "her alanda en iyi" iddiası benchmark'a göre değişiyor.
Gün içinde değişen sayılar
Fortune, lansman blog yazısının arşiv kopyalarını karşılaştırdı ve bazı sayıların gün içinde değiştiğini belgeledi. Halüsinasyon oranı önce yüzde 4,2 (Sol yüzde 12,2) diye yayımlandı, öğlen yüzde 2'ye (Sol yüzde 9,4) indi, sonra ilk hâline döndü. Fable 5.1'in FrontierMath skoru yüzde 87,8'den yüzde 78'e düşüp yüzde 83'e çıktı. ARC-AGI-3 için ambargolu taslakta yüzde 98,6 yazıyordu, canlı yazıda yüzde 99,99. OpenAI'ın açıklaması: çoğu değerlendirmede kontrol noktası, iskele ve koşuma bağlı birkaç puanlık gürültü var, sayılar "en iyi tahmini" yansıtacak şekilde düzeltildi. Sistem kartının yayımı da normalden geç oldu.
Güvenlik tarafında iki sayı
Sistem kartına göre gizli komut enjeksiyonu (indirect prompt injection, yani modelin okuduğu bir belgeye saklanan talimat) testinde Astra 15 denemelik senaryoların yüzde 8,5'inde kandırıldı; Sol'da bu oran yüzde 27'ydi, Claude Opus 5'te yüzde 4,8. Çok turlu ısrarcı jailbreak denemelerinde savunma oranı yüzde 67 civarında kalıyor. İleri siber yetenekler ise API'de kapalı: istismar kodu üretme gibi işler Daybreak programındaki onaylı savunuculara ayrılmış durumda.
Mimari tarafında OpenAI, Astra'nın "döngülü transformer" yapısı kullandığını doğruladı: aynı ileri geçiş, çıktı üretmeden önce birden fazla kez uygulanıyor. Baş bilimci Jakub Pachocki hesaplama derinliğinin GPT-4'ün iki katını aşmadığını söylüyor; güvenlik araştırmacılarının endişesi ise bu döngülerin düşünce zincirinde görünmeyen akıl yürütmeye alan açması.
Türkiye'deki ekipler için hesap
Bizim okumamız şu: fiyat Fable 5.1 ile aynı, Sol'un 2,5 katı. Günde 10 bin belge işleyen bir akış için bu, aylık faturada doğrudan 2,5 kat demek; farkı kapatacak kazanım bilgisayar kullanan ajanlarda ve uzun bağlamda var (1 milyon tokenlik iğne-samanlık testinde yüzde 96,3'e karşı yüzde 73,8), sıradan metin işlerinde yok. Önerimiz, ChatGPT tarafında Plus'a geliş beklenirken API'de kendi iş yükünüzle 100 örneklik küçük bir A/B koşmak. Enjeksiyon oranı üçte bire inmiş olsa da sıfır değil: dış belge okuyan ajanlarda insan onayı adımını kaldırmayın.
Kaynaklar: OpenAI: GPT-6 Astra, ARC Prize: Astra sonuçları, The Decoder: plan ve mesaj limitleri, Fortune: değişen metrikler, The Decoder: sistem kartı güvenlik verileri, OpenRouter: fiyat ve bağlam

Yazan
Muhammet Fatih Batman
Kurucu & Editör
Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucusu.