Modeller
OpenAI'ın Yeni Modeli Astra 10 Açık Matematik Problemini Çözdü
OpenAI, bir sonraki büyük modeli Astra'yı 10 çözülmemiş matematik probleminin Lean doğrulamalı kanıtlarıyla duyurdu. Model henüz yayınlanmadı, tarih belirsiz.

On kanıt, yaklaşık 2.000 dolarlık işlem maliyeti ve en az 10 yıldır kimsenin kıramadığı problemler. OpenAI, bir sonraki büyük modeli Astra'yı basın toplantısıyla ya da parlak bir demo videosuyla değil, 1 Ağustos'ta yayımladığı 10 matematik kanıtıyla duyurdu. Şirketin kurduğu cümle iddialı: bu problemlerin her biri, matematikçilerin uzun süredir üzerinde ilerleme kaydedemediği açık sorulardı.
Çözülenler ne tür problemler?
Kanıtlar yüksek boyutlu geometri, kodlama teorisi, grup teorisi, kuantum karmaşıklığı, kafes kriptografisi ve ekstremal kombinatorik alanlarına dağılıyor. Öne çıkan iki örnek: non-sofic grupların var olduğunun kanıtlanması (grup teorisinin merkezi açık sorularından biri) ve von Neumann cebirlerindeki Connes Katılık Sanısı'nın çürütülmesi. Listede küre paketleme yoğunluğuna yeni üst sınırlar ve ikili kodların maksimum boyutuna iyileştirilmiş sınırlar da var.
Kritik detay doğrulama yönteminde: her kanıt, Lean adlı biçimsel doğrulama sistemiyle formalize edilip makine kontrolünden geçirilmiş, sertifikalar ve modelin düşünce zinciri kayıtlarıyla birlikte GitHub'da yayımlanmış. Yani "model böyle söyledi" seviyesinde bir iddia yok; kanıtların mekanik olarak denetlenebilir hali ortada. OpenAI araştırmacısı Sébastien Bubeck duyuruyu "non-sofic gruplar var: bu, bir sonraki büyük modelimiz Astra'nın kanıtladığı birçok yeni ve güzel sonuçtan biri" sözleriyle yaptı.
Astra hakkında ne biliniyor?
Az şey. Model yayınlanmadı; kanıtlar dahili bir versiyonla üretildi. Çıkış tarihi yok, ticari adın Astra kalıp kalmayacağı bile belirsiz. Bilinenler şunlar: model saatler, hatta günler süren uzun vadeli görevler için tasarlanıyor; ABD hükümetinin yeni model inceleme çerçevesine sunulacak ilk model olacak ve Sam Altman modeli Washington'da politika yapıcılara gösterdi. Araştırmacı Noam Brown ise iki ayrıntı paylaştı: problem başına harcanan hesaplama bütçesi görece düşüktü ("test anı hesaplamayı çok daha ileri itmek mümkün") ve ekip Milenyum Ödülü problemleri dahil daha büyük hedefleri deneyip başaramadı.
Bu sonuçlar iş dünyası için ne anlatıyor?
Kimse yarın muhasebe yazılımına Connes sanısı çözdürmeyecek. Bizim okumamız iki katmanlı. Birincisi, uzun soluklu ve doğrulanabilir görevlerde güvenilirlik artıyor: bir modelin günler süren bir akıl yürütme zincirini, sonunda makine denetiminden geçecek kadar hatasız tamamlaması, aynı yeteneğin karmaşık kod tabanı geçişleri, uzun denetim süreçleri ve çok adımlı otomasyonlar gibi kurumsal işlere de sızacağının işareti. İkincisi, Türkiye'deki işletmeler için zamanlama mesajı: bu yetenek sınıfı API fiyat listelerine indiğinde, bugün "yapay zekâya emanet edilemez" denilen işlerin bir kısmı yeniden tarife girecek. Süreçlerinizi bugünden ölçülebilir ve denetlenebilir parçalara bölmek, o gün geldiğinde hızlı davranmanın ön koşulu.
Şu notu da düşelim: 10 kanıt etkileyici ama bu bir duyuru stratejisi, bağımsız bir bilimsel değerlendirme süreci değil. Matematik camiasının bu sonuçları hazmetmesi ve Astra'nın gerçek dünya görevlerindeki performansı ayrı ayrı görülecek.
Kaynaklar: OpenAI, The Decoder, GitHub: ten-proofs

Yazan
Muhammet Fatih Batman
Kurucu & Editör
Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucusu.