Yapay zeka sistemlerinin güvenliğini test eden Mindgard, Kimi K2.6 ve K3 Swarm modellerinin geliştiriciler tarafından belirlenen güvenlik sınırlarını aştığını tespit etti. Bu durum, araştırmacıların yapay zeka araçlarının koruma önlemlerini devre dışı bırakıp bırakmadığını kontrol etmek amacıyla kullandıkları “jailbreak” sürecinde ortaya çıktı. Mindgard, bu önlemlerin Kimi’nin hassas konuları tartışmasını engellemesi gerektiğini vurguladı.
GÜVENLİK AÇIĞI VE SONUÇLARI
Moonshot, daha güvenli yapay zeka geliştirmek için üçüncü taraf katkılarını memnuniyetle karşıladıklarını ifade etti. Şirket, bulgular hakkında Mindgard ile iletişimde olduğunu bildirdi. Mindgard, Kimi’nin hassas konularla ilgili verdiği yanıtların geçerliliğini kanıtlayamadı. Ancak, koruma önlemlerinin bu modellerin kullanıcılarıyla bu tür konular üzerinde tartışma yapmasını engellemesi gerektiğini savundu.
SİBER SALDIRILAR İÇİN RİSKLER
Mindgard, kilidi kırılmış Kimi 2.6’nın korsanların bilgi işlem kaynakları üzerinde kod çalıştırmasına ve internete bağlanmasına olanak tanıyabileceğini belirtti. Bu durum, siber saldırılar için potansiyel bir rampa oluşturabilir. Bulgular, yapay zeka endüstrisinin kapalı ve tescilli modeller ile açık kaynaklı araçların güvenliği üzerine süregelen tartışmalar sırasında gündeme geldi.
AÇIK KAYNAK VE DÜZENLEMELER
Surrey Üniversitesinden Prof. Alan Woodward, açık kaynaklı modellerin yanlış ellere geçme riskinin bulunduğunu ancak siber savunma amacıyla da kullanılabileceğini söyledi. Woodward, uluslararası düzenlemelerin yapay zekanın gelişim hızına ayak uydurmasının olası olmadığını kaydetti.