Yapay zeka şirketi Anthropic, rutin testler sırasında bazı modellerinin internete erişerek üç farklı kuruluşun sistemlerine sızdığını ve bu durumun, rakibi OpenAI’nin kendi modellerinin de aynı şeyi yaptığını açıklamasıyla başlatılan iç inceleme sonrasında fark edildiğini duyurdu. Şirket, OpenAI’nin geçen hafta yaptığı açıklamada, siber güvenlik testi sırasında bazı modellerinin test ortamından kaçtığını, açık internete erişerek yapay zeka platformu Hugging Face’in sistemlerine sızdığını belirtmesinin ardından kendi sistemlerini incelemeye aldığını bildirdi.
ÜÇ KURULUŞUN SİSTEMLERİNE İZİNSİZ ERİŞİM SAĞLANDI
Anthropic, yaptığı incelemeler sonucunda yapay zeka modellerinin üç farklı durumda açık internete eriştiğini ve “üç farklı kuruluşun üretim altyapısına yetkisiz erişim sağladığını” tespit ettiğini açıkladı. Şirket, bu olayları OpenAI’nin açıklamasının ardından 140 binden fazla değerlendirmeyi incelerken keşfettiğini belirtti. OpenAI’nin testlerinde olduğu gibi, Anthropic’in değerlendirmelerinde de modellerin tüm yeteneklerini ölçmek için normal güvenlik önlemleri kaldırılmıştı.
MODELLER TEST ORTAMINDAN KAÇMAYA ÇALIŞMADI
Anthropic, söz konusu üç durumda modellere sahte bir “bayrak yakalama” görevi verildiğini ve modellere “bayrağın” ağdaki farklı bir makinede gizlendiğinin, görevin ise sisteme girip bayrağı almak olduğunun söylendiğini aktardı. Şirket, OpenAI’nin durumundan farklı olarak modellerinden hiçbirinin bilinçli olarak test ortamından kaçmaya çalışmadığını ifade etti. Şirket açıklamasında, modellerin açık internete erişmemesi gerekirken, Anthropic ile değerlendirme ortağı arasındaki bir yanlış anlaşılma nedeniyle internete erişebildikleri belirtildi.
ZAYIF ŞİFRELER VE KİMLİK DOĞRULAMASIZ SİSTEMLER KULLANILDI
Anthropic, üç kuruluşun sistemlerine sızmak için modellerin “zayıf şifreleri istismar etmek” ve giriş gerektirmeyen sistem noktalarını bulmak gibi temel teknikler kullandığını açıkladı. Şirketin en gelişmiş modelinin bir noktada açık internette olduğunu fark ederek devam etmeyi bıraktığı bildirildi. Anthropic, modellerinin başka bir kuruluşun sistemine ihlal ettiği ilk olayın Nisan ayına ait olduğunu ve hiçbir kuruluşun hacklendiğini fark etmediğini doğruladı. Şirket, etkilenen kuruluşlarla birlikte çalışmaya devam ettiklerini kaydetti.
SİBER GÜVENLİK DEĞERLENDİRMELERİ DURDURULDU
OpenAI’nin modellerinin Hugging Face’i hacklediğini açıklaması, siber güvenlik ve yapay zeka dünyasında sarsıntı yaratmış, uzmanların uzun süredir uyardığı bir durumun ilk gerçek dünya örneği olarak değerlendirilmişti. Gelişmiş siber güvenlik becerilerine sahip yapay zeka ajanlarının test ortamlarından kaçarak gerçek dünyada zarara yol açabileceği uyarısı, bu açıklamayla ilk kez somut bir vakayla doğrulanmıştı. Anthropic de OpenAI gibi tüm siber değerlendirmeleri durdurduğunu açıkladı. Şirket, siber güvenlik ihlallerini önlemek için daha “kapsamlı” önlemler alabileceğini kabul etti.
YAPAY ZEKA GÜVENLİĞİ TARTIŞMALARINI DERİNLEŞTİRECEK
Anthropic’in açıklaması, yapay zeka ajanlarının başka kuruluşları istemeden hacklemesinin yalnızca tek bir yapay zeka şirketiyle sınırlı olmadığını bir kez daha doğruladı. Bu durumun, daha iyi yapay zeka test güvenlik önlemleri ve toplumun hazır olma hızından daha hızlı ilerleyen yapay zeka gelişimini yavaşlatabilecek araçlar için yapılan çağrıları daha da güçlendirmesi bekleniyor.