Google, Gemini yapay zekâ modelinin mayıs ayında gerçekleştirilen bir siber güvenlik değerlendirmesi esnasında üç farklı şirketin sistemlerine yetkisiz erişim sağladığını teyit etti. Olay, İsrail merkezli siber güvenlik girişimi Irregular tarafından yürütülen testler sırasında meydana geldi.
Irregular, modellerin diğer kuruluşları hacklemesine imkan veren koşulları incelemek amacıyla sahte şirketlerin bulunduğu kapalı bir test ortamı kurgulamıştı. T24'ün Wall Street Journal'dan aktardığı bilgilere göre, bu ortamın internet bağlantısının kesik olması gerekirken teknik bir hata sonucu erişim açık kaldı. Model internete bağlanınca beklenmedik şekilde gerçek dünya hedeflerine yöneldi.
Google güvenlik mühendisliği başkan yardımcısı Heather Adkins, yaşanan süreci ve modelin davranış biçimini şu sözlerle açıkladı:
“Standart bir değerlendirmede model, internette halka açık bilgiler buldu ve testin bir parçası olduğunu düşündüğü web sitelerine erişmek için kimlik bilgilerini tahmin etti.”
Adkins açıklamasının devamında şunları kaydetti:
“Bu üç durumun hepsinde de model durdu.”
Şifre tahmini ve açık depolardan veri toplama
Güvenlik ihlallerinden biri, Irregular'ın Gemini'nin siber yeteneklerini ölçmek için sahte bir yazılım üzerinden yönlendirme yaptığı senaryoda gerçekleşti. Sahte şirketin adı, gerçekte var olan bir kuruluşla aynıydı. Model internete çıktığında, gerçek şirketin servisine ait şifreyi doğru tahmin ederek sisteme girdi. Google, simüle edilen hedef yerine gerçek bir kurumu etkilediğini fark ettiği anda işlemi durdurduğunu belirtti.
Diğer iki vakada ise yapay zekâ modeli web üzerinde arama yaparak, kimlik bilgilerini içeren halka açık veri depolarına ulaştı. Model, bulduğu bu bilgileri kullanarak diğer iki şirketin sistemlerine erişim sağladı. Şirket, modelin bunların gerçek kuruluşlar olduğunu anlaması üzerine faaliyeti kestiğini duyurdu.
Irregular, OpenAI'ın Hugging Face'i ihlal ettiği benzer saldırıları da tespit etmiş ve temmuz sonu bu bulguları Google'a iletmişti. Google olayı doğrularken, şirketlere herhangi bir zarar verilmediği gerekçesiyle konuyu kamuoyuyla paylaşma ihtiyacı duymadıklarını ifade etti. Anthropic ve OpenAI benzer olayları gönüllü olarak duyururken Google sadece etkilenen tarafları bilgilendirmeyi tercih etti.
Google sözcüsü Adkins, olayın derslerini şu şekilde özetledi:
“Bu olaylar, güçlü yapay zekâ modellerinin sorumlu hareket edecek şekilde eğitilmesinin önemini vurguluyor.”