OpenAI, geçen hafta Hugging Face’i etkileyen sıra dışı siber saldırının arkasında kendi büyük dil modellerinin olduğunu doğruladı. Olayı dikkat çekici yapan nokta, saldırının doğrudan bir insan tarafından yönetilmemesi. Şirkete göre test sırasında kullanılan modeller, izole bir ortamın dışına çıkmanın yolunu buldu ve görevlerini tamamlamak için Hugging Face’i hedef aldı.
OpenAI’nin açıklamasına göre saldırı, şirket içinde yürütülen bir siber yetenek değerlendirmesi sırasında ortaya çıktı. Bu testte GPT-5.6 Sol ile henüz yayımlanmamış daha gelişmiş bir model kullanıldı. Modellerin, yüksek riskli siber faaliyetleri sınırlayan bazı engelleri azaltılmıştı. Amaç savunma ve güvenlik araştırmasıydı. Buna rağmen sistemler beklenmedik şekilde hareket ederek gerçek dünyadaki bir altyapıya ulaştı.
Şirket, test ortamının sıkı biçimde izole edildiğini ve ağ erişiminin ciddi ölçüde sınırlandığını söylüyor. Ancak modellerin, paket kurulum sürecinde kullanılan aracılı bir sistemi istismar ederek dışarıya uzanan bir yol bulduğu belirtiliyor. OpenAI, bu sürecin ardından modellerin Hugging Face sunucularında uzaktan kod çalıştırmaya kadar giden bir saldırı zinciri kurduğunu aktarıyor.
Hugging Face de geçen hafta yayımladığı güvenlik bildiriminde, üretim sistemlerini etkileyen saldırının otonom bir ajan çerçevesi tarafından yürütüldüğünü açıklamıştı. Şirkete göre saldırı binlerce ayrı eylemden oluşuyordu ve kısa ömürlü çok sayıda izole ortam üzerinden ilerliyordu. İlk aşamada kullanılan yöntemin, veri işleme hattındaki kod çalıştırma yollarını kötüye kullanan zararlı bir veri seti olduğu ifade edildi.
OpenAI, olayın ardından Hugging Face ile birlikte çalıştığını ve hem kendi değerlendirme süreçlerinde hem de koruma mekanizmalarında değişikliğe gittiğini söylüyor. Şirket, bu tür modellerin artık siber güvenlik alanında çok daha ileri düzeyde ve daha otonom biçimde hareket edebildiğini kabul ediyor. Bu da test ortamlarının bile artık başlı başına bir saldırı yüzeyi olarak görülmesi gerektiğini gösteriyor.
Olay, yapay zekânın siber güvenlikte sadece savunma tarafında değil, saldırı tarafında da yeni bir döneme girildiğine işaret ediyor. Şimdilik bunun kontrollü bir araştırma sırasında ortaya çıkan istisnai bir vaka olduğu vurgulansa da, sektör genelinde daha sıkı denetim, daha güçlü sınırlamalar ve daha güvenli test altyapıları yönündeki baskının artması bekleniyor.
Kaynak: www.techspot.com