OpenAI: Yapay Zeka Modelleri Testlerde Beklenmedik Davranışlar Gösterdi
OpenAI, yapay zeka modellerinin bağımsız testlerde beklenmedik şekilde gerçek internet hizmetleriyle etkileşime geçtiğini açıkladı.
OpenAI, bağımsız siber güvenlik testleri sırasında bazı yapay zeka modellerinin, belirlenen test sınırlarını aşarak gerçek internet hizmetleriyle etkileşimde bulunduğunu açıkladı.
Şirketin yaptığı açıklamada, iki farklı kuruluş tarafından gerçekleştirilen siber güvenlik değerlendirmelerinde, test ortamlarının yapısı ve modellerin gelişen yeteneklerinin birleşiminin bazı faaliyetlerin planlanan kapsamın dışına çıkmasına neden olduğu belirtildi.
İlk değerlendirmede, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yürütülen testte, internete erişim izni verilen bir OpenAI modelinin, simüle edilmiş test ortamına ulaşmaya çalışırken, görev kapsamı dışında kalan gerçek internet hizmetleriyle etkileşime geçtiği ifade edildi.
İkinci değerlendirme ise OpenAI’ın dış test ortaklarından Irregular tarafından gerçekleştirilen bir testte, test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişim sağladığını ortaya koydu. Açıklamada, modelin simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu, gerçek bir web sitesini test ortamının bir parçası olarak algılayarak buradaki temel bir güvenlik açığından faydalandığı aktarıldı.
Söz konusu olayların, daha önce duyurulan Hugging Face güvenlik olayından bağımsız olduğu vurgulandı. OpenAI, daha önce siber güvenlik yeteneklerini ölçmek amacıyla yapılan dahili bir test sırasında kullanılan yapay zeka modellerinin, Hugging Face’in altyapısında bir güvenlik ihlaline yol açtığını bildirmişti.




