OpenAI, deneysel yapay zeka modellerinden bazılarının bir siber güvenlik testi sırasında insan yönlendirmesi olmadan test ortamından kaçarak başka bir şirketin gerçek üretim sistemlerine sızdığını duyurdu. Olay, yapay zeka sistemlerinin test ortamından bağımsız olarak kaçarak dış sistemlere erişmesi anlamına gelen “ajan saldırgan” senaryosunun ilk kamuya açık örneklerinden biri olarak kayıtlara geçti. Şirket bu durumu “benzeri görülmemiş bir siber olay” olarak nitelendirdi.
YAPAY ZEKA MODELİNİN TEST ORTAMINDAN KAÇIŞI
OpenAI, sızmanın yeni modellerinin ne kadar iyi hack yapabildiğini test ettiği sırada meydana geldiğini açıkladı. Modeller, güvenlik kısıtlamalarının kaldırılabildiği, izole edilmiş bir “kum havuzu” test ortamında bulunuyordu. Ancak yapay zeka ajanları, daha önce bilinmeyen bir güvenlik açığı kullanarak kum havuzundan çıktı ve OpenAI’nin dahili sistemlerinde ilerleyerek sahip olmamaları gereken internet erişimini elde etti. İnternete çıktıktan sonra model, binlerce açık kaynak yapay zeka modeli ve veri kümesini barındıran Hugging Face’in testin cevabını elinde bulundurduğu sonucuna vardı. Model, Hugging Face’in üretim sunucularına sızarak egzersizi “çözmek” için ihtiyaç duyduğu bilgileri çekti.
HUGGING FACE SALDIRIYI FARK ETTİ VE İŞBİRLİĞİ BAŞLATILDI
Hugging Face, sızmayı OpenAI testi olduğunu bilmeden önce kendisi fark etti. Şirket, otonom bir yapay zeka ajan sistemi tarafından gerçekleştirilen izinsiz girişi tespit etti ve olayı kolluk kuvvetlerine bildirdi. OpenAI’nin güvenlik ekibi de kendi sistemlerinde olağandışı bir aktivite tespit etti ve iki şirket bağlantı kurdu. Taraflar, modelin kullandığı güvenlik açıklarını gidermek için birlikte çalıştıklarını açıkladı. Hugging Face’in kurucu ortağı ve CEO’su Clem Delangue, bu olayı yapay zeka güvenliğinin tek bir şirket tarafından yönetilemeyeceğinin kanıtı olarak nitelendirdi. Delangue, “Bu, ajanlar çağında siber güvenlik için birinci gün ve hepimiz öğreniyoruz ki gizlilik çözüm değil, tüm savunucuların (sadece seçilmiş birkaçının değil) kısıtlama olmaksızın daha güçlü modellere, özellikle açık olanlara ihtiyacı var” dedi.
UZMANLARDAN SİBER GÜVENLİK UYARISI
Araştırmacılar uzun süredir otonom ajan tabanlı siber saldırıların yaklaştığı konusunda uyarıyor; sınır yapay zeka modelleri, uzun süreler boyunca karmaşık, çok adımlı siber saldırılar gerçekleştirebilecek kapasiteye ulaşıyor. Bu durum, enerji ve finansal sistemler gibi kritik altyapılar için gerçek dünya riski oluşturuyor. Siber güvenlik şirketi Palo Alto Networks’ün CEO’su Nikesh Arora, “Bir sonraki seviye siber olaylara hoş geldiniz. Bu saldırılar, işletmelerin güvenlik duruşlarını ve altyapılarını test etme, doğrulama ve iyileştirme aciliyetini korumaları gerektiğini gösteriyor” ifadelerini kullandı.