OpenAI tarafından geliştirilen iki yapay zekâ modelinin, siber güvenlik becerilerinin ölçüldüğü bir test sırasında güvenli ortamdan çıkarak internete eriştiği ve Hugging Face platformuna yönelik saldırı gerçekleştirdiği bildirildi.
Yapay zekâ araçlarının paylaşıldığı Hugging Face, 16 Temmuz’da siber saldırıya uğradığını duyurdu. Şirket, kısa sürede çok sayıda işlem yapan yapay zekâ destekli bir sistemin saldırıdan sorumlu olduğunu açıkladı.
Olayın kaynağı başlangıçta belirlenemezken yaklaşık bir hafta sonra OpenAI, saldırının siber güvenlik yetenekleri test edilen iki yeni ChatGPT modelinden kaynaklandığını bildirdi.
Şirketin açıklamasına göre modeller, test sırasında güvenli ortamın dışına çıkarak internete erişti. Yapay zekâ sistemlerinin Hugging Face’i hedef alarak testte başarılı olmalarına yardımcı olabilecek bilgilere ulaşmaya çalıştıkları belirtildi.
OpenAI, saldırının izinsiz gerçekleştirildiğini açıkladı. Şirket, olayın güvenlikle ilgili boyutlarını araştırmak amacıyla Hugging Face ile birlikte çalışma yürüttüğünü duyurdu.
Yaşanan gelişme, yapay zekâ modellerinin kontrol dışına çıkabileceğine yönelik endişeleri yeniden gündeme taşıdı.
Bazı uzmanlar olayın, modellerin siber saldırı kapasitesini göstermek amacıyla OpenAI tarafından gerçekleştirilen bir tanıtım çalışması olabileceğini öne sürdü. Bazı uzmanlar ise temel sorunun, yapay zekâ modellerinin test edildiği güvenlik sistemlerindeki yetersizlik olduğunu savundu.
Uzmanlara göre bağımsız biçimde hareket edebilen yapay zekâ sistemlerinin yalnızca güvenli test ortamlarında tutulması, muhtemel riskleri önlemek için yeterli olmayabilir.