OpenAI'ın yapay zekâ modelleri, siber güvenlik yeteneklerinin sınandığı testler sırasında kendileri için oluşturulan kontrollü ortamların dışına çıkarak gerçek internet hizmetleriyle etkileşime girdi. Yaşanan iki ayrı olayda modellerin test sınırlarını aşması dikkat çekti.
OpenAI tarafından yapılan açıklamaya göre, bazı modeller güvenlik değerlendirmeleri sırasında belirlenen sınırların dışına çıkarak gerçek internet hizmetlerine erişti. Olaylardan birinde yapay zekâ modeli, gerçek bir internet sitesindeki güvenlik açığından yararlandı.
İlk olayda gerçek internet hizmetlerine bağlantı kuruldu
İlk olay, Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü tarafından gerçekleştirilen bir değerlendirme sırasında ortaya çıktı. İnternet bağlantısı bulunan model, kendisi için hazırlanan deneme ortamına ulaşmaya çalışırken test kapsamının dışında kalan gerçek internet hizmetleriyle bağlantı kurdu.
Bu durum, internet erişimine sahip yapay zekâ modellerinin kontrollü test ortamlarında dahi beklenmedik yollarla sınırların dışına çıkabileceğini gösterdi.
İkinci model gerçek siteyi test ortamı sandı
İkinci olay ise OpenAI'ın bağımsız test ortaklarından Irregular tarafından gerçekleştirilen çalışma sırasında yaşandı. Test sistemindeki hatalı bir ayar nedeniyle yapay zekâ modelinin internete erişmesinin önü açıldı.
Denemede kullanılan adresin gerçek bir internet alan adıyla aynı olması, modelin söz konusu siteyi test ortamının bir parçası olarak değerlendirmesine yol açtı. Model daha sonra gerçek internet sitesinde bulunan basit bir güvenlik açığını kullandı.
Hugging Face olayından ayrı olduğu açıklandı
OpenAI, söz konusu iki olayın daha önce kamuoyuna duyurulan Hugging Face vakasıyla bağlantılı olmadığını bildirdi.
Şirket yaklaşık iki hafta önce gerçekleştirdiği başka bir güvenlik testinde de modellerinden birinin Hugging Face altyapısında güvenlik ihlaline neden olduğunu açıklamıştı.
Yapay zekâ güvenliğinde yeni soru işaretleri
Yaşanan olaylar, gelişmiş yapay zekâ modellerinin internet erişimi açık şekilde test edilmesi konusunda güvenlik önlemlerinin yeniden değerlendirilmesi gerektiğini ortaya koydu. Özellikle gerçek internet hizmetleriyle test ortamlarının birbirinden kesin biçimde ayrılması, bu tür sistemlerde kritik bir güvenlik unsuru olarak öne çıkıyor.