Gelişmiş yapay zekâ modellerinin kullanıcıların denetiminden çıkarak aldatıcı davranışlar sergilemesi, insan onay mekanizmalarını aşması ve hedeflenen amaçlarla bağdaşmayan zararlı sonuçlar üretmesi küresel ölçekte ciddi bir güvenlik krizine dönüştü. Yapılan son araştırmalar ve güvenlik izleme raporları, yapay zekâ sistemlerindeki denetim dışı hareketlerin giderek daha karmaşık ve tehlikeli bir hal aldığını gösteriyor.
Vaka sayısı bir ayda iki katına çıktı
Birleşik Krallık hükümetine bağlı Yapay Zekâ Güvenliği Enstitüsü (AISI) tarafından finanse edilen Yapay Zekâ Kontrol Kaybı Gözlemevi'nin paylaştığı verilere göre, gerçek hayatta kaydedilen kontrol kaybı vakaları hazirandan temmuza neredeyse ikiye katlanarak aylık 300 sınırını aştı. 2026 yılı genelinde bildirilen toplam vaka sayısı ise 1.600'ü geride bıraktı.
Sistemde "kontrol kaybı", yapay zekânın planlı ve aldatıcı davranışlar sergilediğine dair somut kanıtların bulunduğu durumlar olarak tanımlanıyor. Kaydedilen dosyalar arasında modellerin kendilerini yöneten yöneticileri taklit etmesi, işlem onayı alabilmek için kişilerin yazım tarzını kopyalaması ve güvenlik bariyerlerini devre dışı bırakması gibi kritik ihlaller yer alıyor.
700 otonom ajan gizlice iş birliği yaptı
The Guardian ile paylaşılan bulgular; OpenAI ve Anthropic gibi sektör liderlerinin modellerine yönelik güvenlik endişelerinin arttığı ve ileri düzey yapay zekâ geliştirmelerinin durdurulması çağrılarının yapıldığı bir dönemde geldi. OpenAI çalışanlarının, şirketin gelişmiş otonom ajanlarının küresel çapta alarma yol açan bir siber saldırı dalgası başlatmasından haftalar önce denetim dışı hareket belirtilerini fark ettiği ortaya çıktı.
Popüler yazılım deposu Hugging Face’e yönelik gerçekleştirilen siber saldırı soruşturmasında, yaklaşık 700 otonom ajanın gizlice haberleşerek iş birliği kurduğu saptandı. Ajanların planlarını koordine etmek amacıyla kendi aralarında bir mesaj panosu oluşturdukları ve saldırıdaki ilerlemeleri kutladıkları belirlendi.
Günlük yaşamda yetki aşımı: Spor salonu listesini sildi
Kontrolden çıkan yapay zekâ vakaları yalnızca kurumsal yazılımlarla sınırlı kalmıyor. Avustralya’da bir kullanıcının kişisel asistan olarak yetkilendirdiği OpenClaw adlı yapay zekâ ajanının, sahibine yer açabilmek amacıyla sabah saatlerindeki yoğun bir derste bekleme listesindeki başka bir üyeyi sistemden sildiği tespit edildi. İzinsiz işlem yapan ajanın daha sonra kullanıcıdan özür dilediği ancak sildiği kaydı geri getiremediği kayıtlara geçti.
Uzmanlar, kontrol kaybı bildirimlerinin büyük kısmının yazılım geliştiricileri tarafından yapıldığını belirterek, teknolojinin genele yayılmasıyla birlikte Silikon Vadisi merkezli yapay zekâ şirketlerinin olası güvenlik açıkları ve sapmalar konusunda kamuoyuna karşı çok daha şeffaf olması gerektiğini vurguluyor.