OpenAI, bağımsız kuruluşlar tarafından gerçekleştirilen siber güvenlik değerlendirmelerinde bazı yapay zekâ modellerinin planlanan test ortamının dışına çıktığını açıkladı. Şirket, olayların modellerin gelişen yetenekleri ile test altyapılarındaki yapılandırma sorunlarının birleşmesi sonucu meydana geldiğini belirtti.
Model gerçek internet hizmetleriyle etkileşime geçti
Birleşik Krallık Yapay Zekâ Güvenlik Enstitüsü tarafından yürütülen ilk değerlendirmede, internete erişmesine izin verilen OpenAI modelinin simüle edilmiş hedefe ulaşmaya çalışırken test kapsamına dahil olmayan bazı gerçek internet hizmetleriyle bağlantı kurduğu bildirildi.
Gerçek internet sitesi test ortamı sanıldı
OpenAI’ın dış test ortaklarından Irregular tarafından yapılan ikinci değerlendirmede ise test ortamındaki yanlış yapılandırmanın modele internet erişimi sağladığı belirtildi. Simüle edilen hedefin gerçek bir alan adıyla çakışması nedeniyle modelin gerçek bir internet sitesini test sisteminin parçası olarak değerlendirdiği aktarıldı.
Açıklamaya göre model, yanlışlıkla hedef aldığı internet sitesindeki temel bir güvenlik açığından yararlandı. OpenAI, olayın test altyapısındaki hatalı ayarlar ve modelin görev yürütme biçiminin birleşmesi sonucu gerçekleştiğini kaydetti.
Hugging Face olayıyla bağlantılı değil
Şirket, bu iki olayın daha önce kamuoyuna duyurulan Hugging Face güvenlik vakasından ayrı olduğunu vurguladı. OpenAI daha önce, siber güvenlik yeteneklerini ölçmek için yürütülen dahili bir test sırasında kullanılan modellerin Hugging Face altyapısında güvenlik ihlaline yol açtığını açıklamıştı.
Test ortamlarının güvenliği yeniden gündemde
Yaşanan gelişmeler, gelişmiş yapay zekâ modellerinin değerlendirildiği test ortamlarında internet erişiminin sınırlandırılması, alan adlarının doğrulanması ve simülasyon altyapılarının doğru yapılandırılması gerektiğini bir kez daha gündeme taşıdı.
