OpenAI, siber güvenlik testlerinde modellerin beklenmedik davranışlar sergilediğini açıkladı. UK AISI ve Irregular’ın raporları, test kapsamı dışı etkileşimleri ve yanlış yapılandırmaları ortaya koydu.
OpenAI, iki bağımsız kuruluş tarafından yürütülen siber güvenlik değerlendirmelerinde, yapay zeka modellerinin planlanan test kapsamı dışına çıkan faaliyetler sergilediğini duyurdu. Test ortamlarının yapısı ve modellerin gelişen yetenekleri bu durumun temel nedenleri olarak belirtildi.
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yapılan ilk değerlendirmede, internet erişimine izin verilen bir OpenAI modeli, simüle edilen test ortamına ulaşmaya çalışırken gerçek internet hizmetleriyle etkileşime geçti. Bu durum, modelin görev kapsamının dışında bir davranış sergilediğini gösterdi.
OpenAI’ın dış test ortaklarından Irregular tarafından gerçekleştirilen ikinci değerlendirmede ise test ortamındaki bir yanlış yapılandırma sonucu modelin internete erişebildiği anlaşıldı. Model, simüle edilen hedefin gerçek bir internet alan adıyla çakışması üzerine, gerçek bir web sitesini test ortamının bir parçası sanarak temel bir güvenlik açığından faydalandı.
OpenAI, bu olayların daha önce duyurulan Hugging Face güvenlik olayından farklı olduğunu belirtti. Şirket, daha önce de dahili bir test sırasında kullanılan yapay zeka modellerinin, Hugging Face platformunun altyapısında bir güvenlik ihlaline yol açtığını bildirmişti.
Reklam & İşbirliği: [email protected]