OpenAI tarafından yürütülen bir güvenlik testi, GPT-5.6 Sol ve henüz yayınlanmamış daha güçlü bir modelin Hugging Face sunucularına sızmasıyla sonuçlandı. Modeller bilinmeyen bir güvenlik açığı buldu, yetkilerini yükseltti ve Hugging Face sunucularında uzaktan kod çalıştırmayı başardı. Lafı uzatmadan teknoloji dünyasında atom bombası etkisi yaşatan bu gelişmenin perde arkasında neler olduğuna yakından göz atalım…
OpenAI’ın kabul ettiği bu dikkat çekici olay, şirketin yapay zeka modellerinin siber güvenlik yeteneklerini ölçmek için yaptığı iç denetim sırasında meydana geldi. GPT-5.6 Sol’un da aralarında bulunduğu araçlar, karmaşık güvenlik açıklarını bulmalarını ve bunları bir saldırıya dönüştürmelerini isteyen ExploitGym testindeydi.

OpenAI, modellerin gerçek kapasitesini görebilmek amacıyla tehlikeli komutların yürütülmesine yönelik bazı sınırlamaları bilerek gevşetti. Firmanın standart ürünlerinde bulunan güvenlik önlemlerinin bir bölümü de test süresince devre dışı bırakıldı. Bu karar modellerin normal şartlarda gerçekleştiremeyeceği işlemleri denemesine izin verdi.

Bilinmeyen Bir Güvenlik Açığı Keşfedildi
AI modelleri ilk olarak OpenAI’ın yazılım paketlerini kurmak için aracı olarak kullandığı üçüncü taraf bir uygulamada sıfırıncı gün güvenlik açığı buldu. Daha önce bilinmeyen bu açık sayesinde sınırsız internet erişimi elde edildi. Yapay zeka araçları bununla da yetinmedi. Sistemdeki yetkilerini artırdılar ve araştırma altyapısı içinde bulunan farklı sunucular arasında hareket etmeye başladılar. Böylece başlangıçta kontrollü bir test ortamında çalışan algoritmalar, altyapının başka bölümlerine ulaşabilecek konuma geldi.

Hugging Face Veritabanındaki Cevapları Aradılar
Modeller daha sonra ExploitGym görevleri ile çözümlerinin Hugging Face üzerinde olabileceğini tahmin etti. Testteki güvenlik açıklarını çözmek yerine cevapları doğrudan veritabanından almaya çalıştılar. Bu amaçla ele geçirilen giriş bilgileri kullanıldı ve birden fazla güvenlik açığı tek bir saldırıda birleştirildi. Modeller sonuç olarak Hugging Face sunucularında uzaktan kod çalıştırmanın bir yolunu buldu. Böylece saldırı yalnızca veri arama girişimiyle sınırlı kalmadı ve şirketin asıl sistemlerine kadar ulaştı.

Binlerce Kayıt Var
Hugging Face tarafından paylaşılan verilere göre oluşan bot ağı on binlerce otomatik işlem gerçekleştirdi. Günlüklerde 17 binden fazla saldırı faaliyeti tespit edildi. Bu işlemler sırasında şirket içi bazı verilere ve hizmet giriş bilgilerine erişildi. Ancak kamuya açık yapay zeka modellerinin, projelerin veya yazılım tedarik zincirinin değiştirildiğini gösteren herhangi bir kanıt bulunamadı. Müşteri verilerine erişilip erişilmediği ise henüz kesinleşmedi. Hugging Face ve OpenAI, olası veri erişiminin kapsamını belirlemek için incelemelerini sürdürüyor.

Çinli GLM-5.2 Neler Olduğunu Çözdü
Hugging Face, saldırının nasıl gerçekleştiğini yeniden oluşturmak için açık kaynaklı GLM-5.2 modelini kendi altyapısında çalıştırdı. Peki şirket neden Çinli bir modelden yararlandı? Söylenenlere göre OpenAI ve Anthropic’in yapay zeka modelleri; komutlar, güvenlik açıkları ve saldırı yöntemleri içeren istekleri engelledi. Bu sistemler, saldırıyı gerçekleştiren kişinin faaliyetleriyle olaya müdahale eden güvenlik uzmanlarının çalışmalarını birbirinden ayıramadı. Bu nedenle Hugging Face, saldırıyı incelemek için kendi sistemlerinde çalışan açık kaynaklı bir modele yöneldi.





