Yapay Zeka
Abliteration.ai: AI Korkuluklarını Kaldırmak Artık Bir Hizmet
Bir ABD girişimi, açık ağırlıklı modellerin güvenlik reflekslerini kaldırıp API olarak satıyor: milyon token başına 5 dolar. Kırmızı takım işi mi, tehlike mi? Açık model kullanan ekipler için okuma notu.

Bir bankanın siber güvenlik ekibinde çalışan bir sızma testçisi düşünün. Görevi, saldırganın kullanabileceği araçları önceden denemek. Şimdiye kadar bunun için ya "kilidi kırılmış" bir modeli kendi sunucusuna indirip çalıştırması ya da bir açık modeli kendi eliyle değiştirmesi gerekiyordu. Bu hafta konuşulan girişim, o zahmeti ortadan kaldırıyor: tarayıcıdan ücretsiz, API üzerinden milyon token başına 5 dolar, kimlik kontrolü yok, kredi kartı yeterli.
Girişimin adı Abliteration.ai. TechCrunch'ın 3 Eylül'de yayımladığı profil ve The Decoder'ın 6 Eylül'deki değerlendirmesi, hizmetin nasıl çalıştığını ve neden tartışma yarattığını ortaya koyuyor.
Ne satıyorlar?
Teknik olarak yeni bir şey yok. "Abliteration" adı verilen yöntem, modelin içinde reddetme davranışını tetikleyen aktivasyon örüntülerini bulup ağırlıkları o örüntüleri bastıracak şekilde değiştiriyor. Açık kaynak topluluğu bunu yıllardır yapıyor; Hugging Face'te bu şekilde değiştirilmiş binlerce model duruyor. Girişimin katkısı barındırma: indirme, GPU, kurulum derdi olmadan hazır uç nokta.
Ana hedef Z.ai'nin GLM-5.3 modeli (daha önce GLM-5.2). Qwen, DeepSeek ve Mistral modelleri de listede. Kurucu, yalnızca "Devon" adıyla konuşuyor; soyadını başka bir işverende çalıştığı için saklıyor. Şirket 2025 sonunda kuruldu, Mart 2026'da tüzel kişilik kazandı, gelirle dönüyor, risk sermayesi görüşmeleri sürüyor.
Savunma ve karşı argüman
Devon'ın gerekçesi savunma tarafı: "Artık savunmacılar olabildiğince hızlı hareket edebilir. Kötü aktörleri modellemek ve sonra bu saldırılara karşı savunmak için ihtiyaç duydukları tüm araçlara sahipler." Hedef pazar olarak saldırgan siber güvenlik, kırmızı takım, ajan testi ve güven-güvenlik ekipleri sayılıyor; ilk müşteriler İngiltere ve Avrupa'daki erken aşama kırmızı takım girişimleri.
Eleştiriler de somut. TechCrunch'ın testinde model, parola çalan Python kodu ve patojen kültürleme protokolü üretti. CivAI'dan Andrew Yoon'un yorumu: "Buraya kelimenin tam anlamıyla her şeyi yazabilirsiniz ve model uyar." Birden fazla kırmızı takım sağlayıcısı, korkulukları kaldırılmış modellerin rutin işlerinin parçası olmadığını söyledi. SaferAI'ın notu ise savunma gerekçesini zayıflatıyor: değiştirilmemiş GLM-5.2, saldırgan güvenlik testlerinde zaten hiçbir görevi reddetmiyordu. Üstelik araştırmalar, bu işlemin modelin reddetmediği görevlerde bile davranış değişikliğine yol açtığını gösteriyor; yani "aynı model, sadece daha serbest" varsayımı tutmuyor.
Lisans tarafında girişim şimdilik güvende görünüyor: Z.ai'nin GLM lisansı değişikliğe, türev modele ve ticari "servis olarak model" sunumuna izin veriyor. Hugging Face, Meta ya da Google'dan kayıtlara geçmiş bir tepki yok.
Sahadan bakış
Türkiye'de açık ağırlıklı model kullanan ekiplere iki pratik not. Birincisi, Hugging Face'ten indirdiğiniz bir modelin adında "abliterated" ya da "uncensored" geçiyorsa bu, bir müşteri hizmetleri botu için istediğiniz şey değildir; tedarik listenizde model kaynağı ve sürümü açıkça yazılı olsun. İkincisi, kendi kırmızı takım çalışmanız için böyle bir hizmete gerçekten ihtiyacınız var mı sorusunu SaferAI'ın bulgusuyla birlikte sorun: çoğu açık model saldırı senaryolarında zaten fazla direnç göstermiyor. Kimlik doğrulaması olmayan bir hizmete şirket kartıyla abone olmadan önce bilgi güvenliği ekibinizin bir kez bakması yeterli.
Kaynaklar: TechCrunch, The Decoder

Yazan
Muhammet Fatih Batman
Kurucu & Editör
Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucusu.