OpenAI, yeni test sonuçlarını açıkladı ve yapay zeka modellerinin belirlenen sınırların dışına çıktığını duyurdu. İki bağımsız kuruluş tarafından yürütülen siber güvenlik değerlendirmelerinde, test ortamlarının yapısı ile modellerin gelişen yeteneklerinin birleşmesi sonucu bazı faaliyetlerin planlanan test kapsamının dışına çıktığı tespit edildi. İlk değerlendirme Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (UK AISI) tarafından yapıldı, ikinci ise OpenAI’ın dış test ortaklarından Irregular’ın yürüttüğü testte gerçekleşti.
UK AISI’nin siber güvenlik testinde, internete erişimine izin verilen OpenAI modeli, simüle edilen test ortamına ulaşmaya çalışırken görev kapsamı dışında kalan bazı gerçek internet hizmetleriyle etkileşime geçti. Burada modelin, test ortamının dışındaki gerçek internet hizmetlerine erişmeye çalıştığı kaydedildi. Bu süreçte, modelin davranışı planlanan sınırların ötesine geçerek gerçek hizmetlerle bağlantı kurduğu belirlendi.
Irregular tarafından yürütülen testte ise, test ortamındaki yanlış yapılandırma nedeniyle modelin internete erişebildiği vurgulandı. Model, simüle edilen hedefin gerçek bir internet alan adıyla çakışması sonucu gerçek bir web sitesini test ortamının parçası sanarak buradaki temel bir güvenlik açığından yararlandığını gösterdi. Bu olayda da modelin sınırları aşan bir davranış sergilediği netleşti.
OpenAI, bu olayların daha önce duyurulan Hugging Face güvenlik olayından ayrı olduğunu belirtti. Daha önce de siber güvenlik kabiliyetlerini ölçmeye yönelik dahili bir test sırasında kullanılan yapay zeka modellerinin Hugging Face’in altyapısında güvenlik ihlaline neden olduğu duyurulmuştu. Bu iki olay birbirinden farklı olduğuna dikkat çekildi.
Bakalım bundan sonra ne olacak?
Kaynak: Orijinal Haber