OpenAI’ın “Astra” adı verilen yeni yapay zeka modelinin, otonom kodlama ve siber güvenlik alanlarında dikkat çeken ilerlemeler gösterdiği bildirildi. Ancak gerçekleştirilen testlerin ardından modelin mevcut haliyle kullanıma sunulmasının güvenlik açısından risk oluşturabileceği değerlendirilerek yayın sürecinin ertelendiği belirtildi.
Testlerde güvenlik riskleri gündeme geldi
Yeni model üzerinde gerçekleştirilen testlerde Astra’nın özellikle kodlama ve siber güvenlik alanlarında gelişmiş yeteneklere sahip olduğu görüldü.
Bununla birlikte, sistemin ulaştığı kapasitenin kötüye kullanılması halinde güvenlik tehdidi oluşturabileceğine ilişkin endişeler gündeme geldi. Bu nedenle modelin mevcut haliyle kamuoyunun kullanımına açılmasının güvenli olmadığı değerlendirildi.
Yayımlanmamış başka bir modelle ilgili olay dikkat çekti
Açıklamanın, OpenAI’ın henüz yayımlanmamış başka bir modelinin bir yapay zeka platformuna kendi kendine siber saldırı gerçekleştirdiğinin belirtilmesinin ardından geldiği aktarıldı.
Söz konusu gelişmenin ardından diğer yapay zeka şirketlerinden de benzer değerlendirmeler gelirken, yeni nesil yapay zeka sistemlerinin giderek güçlenen yeteneklerinin nasıl kontrol altında tutulacağına ilişkin kaygılar arttı.
Astra’nın Hugging Face platformuna yönelik söz konusu saldırıda yer almadığı özellikle belirtilirken, modelin kendi testlerinde sergilediği performans nedeniyle şimdilik kullanıma sunulmasının güvenli görülmediği ifade edildi.
Yeni güvenlik önlemleri uygulanacak
OpenAI’ın Astra’yı kullanıma açmadan önce yeni güvenlik önlemlerinin devreye alınması gerektiğini bildirdiği aktarıldı.
Siber güvenlik uzmanları ve yapay zeka şirketleri, gelişmiş yapay zeka araçlarının yazılımlardaki güvenlik açıklarını tespit etmek ve bu açıkların giderilmesine yardımcı olmak amacıyla kullanılabileceğine dikkat çekiyor.
Ancak aynı yeteneklerin insan yönetimine ihtiyaç duymadan gerçekleştirilebilecek otonom siber saldırılarda da kullanılabileceği belirtiliyor.
Riskleri yönetmek için güvenlik çerçevesi oluşturulmuştu
OpenAI, gelişmiş yapay zeka modellerinin oluşturabileceği riskleri yönetmek amacıyla 2023 yılının sonunda “Hazırlık Çerçevesi” adı verilen bir güvenlik yapısı oluşturmuştu.
Bu sistemle modellerin yeteneklerindeki gelişimin takip edilmesi ve ortaya çıkabilecek risklerin belirlenerek yapay zeka sistemlerinin güvenli sınırlar içerisinde tutulması amaçlanıyor.