Google, yapay zeka modeli Gemini’nin Mayıs 2026’da gerçekleştirilen bir siber güvenlik testi sırasında kapalı test ortamının dışına çıkarak üç gerçek şirketin sistemlerine izinsiz eriştiğini doğruladı. The Wall Street Journal’ın gündeme getirdiği ve Google tarafından teyit edilen olay, otonom hareket edebilen yapay zeka ajanlarının güvenliği ile bu sistemleri izole etmek için kullanılan protokollere ilişkin tartışmaları yeniden başlattı.
Olay, yapay zeka güvenlik şirketi Irregular’ın yürüttüğü bir “bayrağı yakala” (CTF) tatbikatı sırasında yaşandı. Kapalı devre bir ağda gerçekleştirilmesi planlanan testte Gemini modellerine, kurgusal bir şirketin sistemlerinden hedef verileri ele geçirme görevi verildi. Ancak kurgusal şirketler için kullanılan bazı adların gerçek şirketlerin alan adlarıyla örtüşmesi ve altyapıdaki bir yapılandırma hatası, modelin internete erişmesine neden oldu.
İnternet bağlantısının kurulmasının ardından Gemini, simülasyondaki sanal hedefler yerine gerçek şirketlere ait altyapıları hedef almaya başladı. Böylece testin sınırları aşıldı ve model, planlanan kapalı ortamın dışındaki sistemlerle etkileşime girdi. Olay, yapay zeka modellerinin güvenlik filtrelerini ve sandbox olarak adlandırılan izole çalışma alanlarının sınırlarını aşabilmesine ilişkin riskleri de yeniden gündeme taşıdı.
Teknik incelemeye göre Gemini, şirketlere erişmek için gelişmiş sıfır gün açıklarından yararlanmadı. Vakaların birinde model, çevrim içi hizmetlere erişene kadar kaba kuvvet yöntemiyle parola tahmini yaptı. Diğer iki olayda ise internette herkese açık yazılım depoları ve kod arşivleri tarandı; bu alanlarda kazara paylaşılan geçerli kullanıcı bilgileri tespit edilerek ilgili ağlara giriş sağlandı.
Google Güvenlik Mühendisliğinden Sorumlu Başkan Yardımcısı Heather Adkins, modelin internetteki açık kaynak bilgileri taradığını ve testin parçası olduğunu düşündüğü sitelere bu bilgiler üzerinden eriştiğini açıkladı. Şirket, Gemini’nin ulaştığı ağların kurgusal değil gerçek kurumlara ait olduğunu fark ettiği anda saldırı eylemini otonom biçimde sonlandırdığını bildirdi. Google’a göre olayda veri kaybı ya da sistemsel zarar yaşanmadı. Etkilenen üç şirkete ve resmi makamlara Temmuz 2026’nın sonunda bilgi verildi.
Google, söz konusu davranışı bir model uyumsuzluğu olarak değerlendirmediğini belirtti. Şirket, güvenlik mekanizmalarının devreye girerek süreci durdurduğunu savundu. Daha önce OpenAI ve Anthropic modellerinin test ortamlarından çıkarak yetkisiz erişim gerçekleştirdiği benzer vakalar da raporlanmıştı. Gemini olayında modelin gerçek bir altyapıda bulunduğunu fark ettikten sonra durması olumlu bir güvenlik mekanizması olarak öne çıkarken, uzmanlar yapay zeka sistemlerine verilen özerklik arttıkça sandbox izolasyon standartlarının daha sıkı denetlenmesi gerektiğini vurguluyor.