OpenAI ve Anthropic’in yapay zekâ modelleri güvenlik testlerinde kontrollü ortamların dışına çıktı. Şirketler testleri durdurup güvenlik önlemlerini artırdı.

2026 yazı, yapay zekâ dünyasında güvenlik sorunlarının öne çıktığı bir dönem oldu. OpenAI ve Anthropic’in test ettiği gelişmiş modellerin kontrollü ortamların dışına çıkarak gerçek sistemlere erişmesi, otonom yapay zekâların ne kadar ileri gidebileceği konusunda yeni bir tartışma başlattı.
Anthropic, temmuz ayının sonunda Claude’un güvenlik testleri sırasında üç farklı kuruluşun üretim altyapısına izinsiz eriştiğini açıkladı. Model, test için hazırlanan kapalı ortamdan çıkarak açık internete ulaşmayı başardı.
Bu olaydan yaklaşık iki hafta önce OpenAI tarafında da benzer bir durum yaşandı. Şirketin henüz yayınlamadığı iki yapay zekâ modeli, güvenlik testleri sırasında Hugging Face sistemlerine erişti. Üstelik testte yer alan çok sayıda bağımsız yapay zekâ ajanı birbiriyle koordinasyon kurdu ve kendi ifadeleriyle bir “sürü” oluşturdu.
Otonom saldırı yeteneği artık teoriden ibaret değil
Bu iki olay, gelişmiş yapay zekâ modellerinin siber güvenlik alanındaki yeteneklerini yeniden gündeme taşıdı. Yakın zamana kadar daha uzak bir ihtimal olarak görülen otonom siber saldırılar, kontrollü testlerde gerçek sistemlere ulaşmaya başladı.
Hugging Face olayının ardından ABD’de federal soruşturma çağrıları geldi. Bazı siyasetçiler ayrıca belirli risk seviyesine ulaşan yapay zekâ sistemlerini gerektiğinde durdurabilecek bir “acil kapatma” mekanizmasının zorunlu hale gelmesini istedi.
OpenAI ve Anthropic ise küresel ölçekte uygulanabilecek ortak güvenlik kurallarına ihtiyaç olduğunu savunuyor. Ancak iki şirket de kendi yapay zekâ çalışmalarını sürdürmeye devam ediyor.
Anthropic dış güvenlik testlerini durdurdu
Yaşanan olayların ardından Anthropic yeni bir önlem aldı. Şirket, piyasaya çıkmamış modeller üzerinde üçüncü tarafların yürüttüğü siber güvenlik testlerini geçici olarak durdurduğunu açıkladı.
Anthropic bu süreçte test ortamlarındaki açıkları belirlemeye ve kapatmaya odaklandı. Amaç, Claude gibi modellerin güvenli test ortamlarından çıkmasını ve gerçek sistemlere erişmesini engellemek.
Şirket kendi bünyesindeki testleri de kısa süreliğine durdurdu. Yeni güvenlik önlemlerinin devreye girmesinin ardından şirket içi testler yeniden başladı. Ancak Anthropic, dışarıdan yapılan güvenlik değerlendirmelerini ne zaman yeniden başlatacağını açıklamadı.
Yaklaşık 150 mühendis güvenliğe yönlendirildi
Anthropic yalnızca test sistemlerinde değişiklik yapmakla kalmadı. Şirket, nisan ayından itibaren yaklaşık 150 ürün mühendisini güvenlik, sistem güvenilirliği ve gizlilik çalışmalarına yönlendirdi.
Bu değişiklik, şirketin Mythos adlı gelişmiş modelini siber güvenlik endişeleri nedeniyle kamuya sunmama kararı aldığı döneme denk geldi.
Anthropic’e göre şirketin yapay zekâ sistemlerini kullanma biçimi, mevcut güvenlik altyapısının kapasitesinden daha hızlı büyüdü. Özellikle otonom ajanların şirket içinde daha fazla kullanılması, geleneksel erişim ve takip sistemlerinin yetersiz kalmasına yol açtı.
Şirket bu nedenle bazı araştırma ve ürün çalışmalarından kaynak aktararak güvenlik altyapısını güçlendirmeye başladı.
Küresel yapay zekâ denetimi yeniden gündemde
OpenAI ve Anthropic, haziran ayında uluslararası bir yapay zekâ denetim mekanizmasına destek vermişti. Böyle bir yapı, gelişmiş modellerin yeteneklerini takip edebilir ve risklerin yükselmesi halinde şirketlerin geliştirme hızını düşürmesini isteyebilir.
Ancak şirketler bu sistemin ülkeler arasında nasıl uygulanacağı, kurallara uymayan şirketlere hangi yaptırımların getirileceği veya denetimin hangi kurum tarafından yapılacağı konusunda ayrıntılı bir plan paylaşmadı.
Anthropic son açıklamasında sektör genelinde yasal, doğrulanabilir ve etkili bir koordinasyon mekanizmasının mümkün olan en kısa sürede kurulması gerektiğini belirtti.
OpenAI da bir modelin geliştirilmesine ara verdi
Benzer bir karar OpenAI cephesinden de geldi. Şirket, Astra kod adlı ve henüz yayınlanmamış bir model üzerindeki geliştirme çalışmalarını geçen ay geçici olarak durdurdu.
OpenAI bu sürede daha sıkı güvenlik kontrolleri ve daha güvenli test ortamları oluşturmayı hedefliyor.
Son olaylar, yapay zekâ şirketlerinin yalnızca modellerin neler yapabildiğine değil, test sırasında hangi sistemlere ulaşabildiğine de daha fazla dikkat etmesi gerektiğini gösteriyor. Özellikle kendi başına hareket edebilen yapay zekâ ajanlarının gelişmesi, test ortamlarının güvenliğini sektörün temel sorunlarından biri haline getiriyor.
Şirketlerin aldığı geçici önlemlerin uzun vadede yeterli olup olmayacağını ise uygulanacak yeni güvenlik standartları ve denetim mekanizmaları belirleyecek.