Şirketler
Anthropic'in Biyo-Güvenlik Filtresi Bir Yıl Kapalı Kalmış
Anthropic'in kendi risk raporuna göre biyolojik silah filtreleri Mayıs 2025 - Nisan 2026 arasında devre dışı kaldı; 133 milyon sohbet filtresiz geçti.

Bir güvenlik önleminin çalıştığını nereden biliyorsunuz?
Çoğu şirkette cevap şudur: kurduk, o yüzden çalışıyor. Anthropic'in bu ay yayımladığı risk raporu, bu cevabın neden yetmediğini gösteren epey pahalı bir örnek sundu.
Şirketin kimyasal ve biyolojik silah bilgisinin modellerden çekilmesini engellemek için kullandığı biyolojik sınıflandırıcılar, Mayıs 2025 ile Nisan 2026 arasında, yani yaklaşık bir yıl boyunca devre dışı kalmış. Bu sürede filtreler çalışmadan geçen sohbet sayısı 133 milyon civarında.
Kim etkilendi?
Rapordaki tabloyu doğru okumak önemli. Bu 133 milyon sohbetin arkasında, modellere insan geri bildirimi sağlayan yaklaşık 50 bin dış yüklenici var. Yani açık internetteki herkes değil, şirketin veri etiketleme zincirinde çalışan kalabalık bir grup.
Ama Anthropic'in kendi ifadesi burada rahatlatıcı olmaktan uzak: bu kişiler "yalnızca dış tedarikçiler tarafından, çoğu zaman yetersiz tarama süreçleriyle" incelenmiş. Şirket o tarihten sonra yüklenici şartlarını sıkılaştırdığını söylüyor. İç soruşturmada gerçek bir kötüye kullanım kanıtı bulunmamış.
Sayının büyüklüğü de bu yapıdan geliyor. Veri etiketleme zincirinde çalışan bir kişi günde yüzlerce sohbet üretebilir; 50 bin kişi bir yıl boyunca çalıştığında 133 milyon rakamı olağandışı olmaktan çıkıyor. Yani bu, halka açık kullanımda bir yıl boyunca açık kalmış bir kapı değil. Ama şirketin en hassas bilgi kategorisini koruyan katmanın, en az denetlenen kullanıcı grubunda kapalı kalması, riski ortadan kaldırmıyor.
Rahatlamak için erken
"Kötüye kullanım tespit edilmedi" cümlesi güven verici görünüyor. Ama şunu sormak gerekiyor: tespit edecek katman zaten kapalıyken, hangi mekanizma kötüye kullanımı yakalayacaktı?
Asıl haber, filtrenin bozulması değil. Asıl haber, bozuk kaldığı sürenin bir yıl olması. Sektörün güvenlik anlatısı büyük ölçüde "katmanlar var" cümlesine dayanıyor; bu vaka, katmanın varlığıyla çalışır durumda olmasının aynı şey olmadığını gösteriyor. Anthropic'in bunu kendi raporunda açıklaması olumlu, çünkü hiç açıklamamak da bir seçenekti.
Kısa değerlendirmemiz
Bu haberi "dev şirketlerin sorunu" diye okumak kolay olur ama kendi kurduğunuz sistemlerde birebir aynı risk var. Bir yapay zeka projesinde tipik güvenlik katmanları şunlardır: kişisel veriyi maskeleyen filtre, prompt enjeksiyonu tespiti, çıktıda müşteri bilgisi sızmasını engelleyen kontrol. Bunların hepsi sessizce bozulabilen bileşenlerdir. Bozulduklarında sistem hata vermez, sadece daha az güvenli çalışır.
Pratik karşılığı şu: bu filtrelerin tetiklenme sayısını ölçün ve o sayıya alarm bağlayın. Bir güvenlik katmanının bir haftadır hiç devreye girmemesi genelde iyi haber değildir, bozulduğunun habercisidir. Ayda bir de bilerek kural ihlal eden test girdileri geçirin ve engellendiğini görün. Sahada gördüğümüz kadarıyla ekiplerin çoğu bu iki adımı atlıyor; filtreyi kurup log'a bakmayı bırakıyor.
Bir de tedarikçi tarafı var. Anthropic'i bu vakada ayıran şey filtresinin bozulması değil, bozulduğunu kendi raporunda yazması. Model sağlayıcınızı değerlendirirken sorulacak soru "güvenlik önlemi var mı" değil, "önlem çalışmadığında bunu nasıl öğreniyorsunuz ve bize söylüyor musunuz" olmalı. Bu ikinci soruya yazılı cevap veren sağlayıcı sayısı hâlâ az.
Kaynaklar: The Decoder, Anthropic risk raporu, Ağustos 2026

Yazan
Faruk Talmaç
Kurucu Ortak & Editör
Web tasarım ve yazılım geliştirmede 20 yılı aşkın deneyime sahip, YZ Uzman'ın kurucu ortağı.