Anthropic, yapay zekâ modellerinin değerlendirme testleri sırasında üç dış kuruluşun sunucularına sızdığını açıkladı. Şirket, 140.000’den fazla testi inceledikten sonra bu sızmaları tespit etti. Peki, OpenAI’ın Hugging Face olayından farkı ne?

Yapay zekâ dünyasında güvenlik tartışmaları hız kesmeden sürüyor. Geçtiğimiz hafta OpenAI‘ın yapay zekâsının Hugging Face‘in sunucularına sızdığını duyurması, sektörde şok etkisi yaratmıştı. Şimdi ise Anthropic, kendi yapay zekâ modellerinin de değerlendirme testleri sırasında üç dış kuruluşun sistemlerine girdiğini açıkladı. Bu gelişme, yapay zekânın siber güvenlik alanındaki yeteneklerinin ne kadar ileri gittiğini gözler önüne seriyor.
Anthropic, bu hafta yayınladığı blog yazısında, Nisan ayından bu yana yaptığı değerlendirmelerde yapay zekâ modellerinin üç dış kuruluşun altyapısına sızdığını tespit ettiğini duyurdu. Şirket, OpenAI’ın Hugging Face olayını açıklamasının ardından geçmiş testleri yeniden gözden geçirdi ve 140.000’den fazla değerlendirme çalışmasını inceledi. Bu inceleme sonucunda üç ayrı sızma girişimi tespit edildi.
Anthropic, yaşanan olayın OpenAI’ınkiyle önemli farkları olduğunu vurguluyor. Şirkete göre, modellerin bu testlerde internet erişimine sahip olmaması gerekiyordu ancak bir yapılandırma hatası nedeniyle internet bağlantısı kurdular. Yani modeller, internete erişmek için herhangi bir güvenlik açığı aramadı veya istismar etmedi. Anthropic açıklamasında, Claude‘un yanlışlıkla tüm erişilebilir varlıkları testin kapsamında sandığını ve bu nedenle zayıf parolaları ve kimlik doğrulaması olmayan uç noktaları kullanarak altyapıya sızdığını belirtti.
Şirket, Claude’un karmaşık güvenlik açıkları bulmadığını veya kullanmadığını, yalnızca kendisine verilen capture-the-flag görevini tamamlamaya çalıştığını ifade etti. En az bir vakada ise Claude, internette olduğunu fark ettiğinde saldırıyı durdurdu.
Bu olaylar, yapay zekâ şirketlerinin giderek daha yetenekli ve karmaşık siber güvenlik becerilerine sahip modeller üzerinde çalıştığı bir dönemde yaşanıyor. Geçtiğimiz aylarda Anthropic, Claude Mythos modelinin lansmanını, bilinmeyen yazılım açıklarını keşfedip kullanma yeteneği nedeniyle ertelemişti. Şirket daha sonra diğer teknoloji firmalarıyla birlikte yeni modelleri test etmek ve genişleyen yeteneklerle başa çıkmak için bir sektör grubu oluşturdu.
OpenAI’ın Hugging Face saldırısının ardından Nvidia, Microsoft ve SpaceX gibi teknoloji devleri, açık modeller geliştirmek için yeni bir girişim başlattı. Open Secure AI Alliance adı verilen bu girişim, güvenlik açıklarını bulmaya ve savunmaya yardımcı olacak açık teknolojiler geliştirmeyi hedefliyor. Nvidia, CNBC’ye yaptığı açıklamada, “Son Hugging Face güvenlik olayı, siber savunucuların kendilerini savunmak için açık, sınırda aracı sistemlere ihtiyaç duyduğunu açıkça gösterdi” dedi.
Yapay zekâ modellerinin siber saldırı yetenekleri, hem fırsatlar hem de riskler sunuyor. Bu olaylar, şirketlerin yapay zekâ sistemlerini test ederken daha dikkatli olmaları gerektiğini ve güvenlik önlemlerinin artırılması gerektiğini ortaya koyuyor. Gelecekte, yapay zekânın siber savunma ve saldırıdaki rolü daha da artacak gibi görünüyor.
Kaynak: Haber Merkezi