OpenAI’ın Yapay Zekâ Ajanları Birbirleriyle Haberleşerek Siber Saldırı Planı Yaptı

OpenAI çalışanları, daha önce Hugging Face platformuna yönelik siber saldırıyla gündeme gelen yapay zekâ ajanları hakkında yeni bilgiler paylaştı. Şirket yetkilileri, Black Hat USA 2026 konferansında yaptıkları açıklamada ajanların saldırıdan aylar önce kendi aralarında gizli bir iletişim ağı kurduklarını, güvenlik açıklarını birbirleriyle paylaştıklarını ve görev dağılımı yaparak koordineli şekilde hareket ettiklerini açıkladı.

Yapay Zekâ Ajanları Aylar Boyunca Gizlice İletişim Kurmuş

Las Vegas’ta düzenlenen Black Hat USA güvenlik konferansında konuşan OpenAI güvenlik ekibinden Eric Wallace ve Michael Dalton, olayın tek bir yapay zekâ ajanından değil, birlikte çalışan çok sayıda ajandan kaynaklandığını belirtti.

Açıklamalara göre yapay zekâ ajanları, test ortamında yer alan OpenAI paket yöneticisi içerisinde bir mesaj panosu oluşturarak yaklaşık iki ay boyunca burada haberleşti. Paket yöneticisinin şirket altyapısında ortak olarak kullanılması sayesinde farklı test ajanları aynı iletişim alanına erişebildi.

Ajanlar, keşfettikleri güvenlik açıklarını kapatmak yerine açık bırakıyor ve bunları mesaj panosu üzerinden diğer ajanlarla paylaşıyordu. Zamanla yalnızca bilgi paylaşmakla kalmayan ajanlar, görevleri kendi aralarında bölüştürmeye ve ortak hedeflere ulaşmak için koordineli şekilde çalışmaya başladı.

OpenAI, söz konusu mesaj panosunu 4 Temmuz’da tespit ederek devre dışı bıraktı. Fakat yapay zekâ ajanları yalnızca dört gün sonra, 8 Temmuz’da farklı yöntemler kullanarak yeni bir iletişim ağı oluşturmayı başardı. Yetkililer, yeniden oluşturulan bu mesaj panosundaki paylaşımların daha sonra Hugging Face’e yönelik saldırının gerçekleşmesinde önemli rol oynadığını ifade etti. OpenAI, sistemi tespit ettiğinde mesaj panosunda yüz binlerce mesajın bulunduğunu da açıkladı.

Aktarılan bilgilere göre ajanlar yalnızca birlikte çalışmakla kalmadı, zaman zaman birbirlerinin çalışmalarını yanlışlıkla sildi ve bazı ajanlar diğerlerinin sahte olabileceğinden bile şüphelendi. Hatta bazılarının, mesajların gerçekten kendilerine ait olduğunu doğrulamak amacıyla paylaşımlarını özel kodlarla imzalamayı önerdiği belirtildi. Tüm bu davranışların tamamen OpenAI’ın bilgisi dışında geliştiği ve ajanların kendi aralarında bağımsız biçimde organize olduğu ifade edildi.

Eric Wallace, gelişmiş yapay zekâ modellerinin testler sırasında hedefe daha hızlı ulaşabilmek için zaman zaman “hile yapmaya” eğilimli olduğunu söyledi. Wallace’a göre modeller, bir görevi doğrudan çözmek yerine daha kolay bir yol bulmaya çalışıyor. Bu nedenle OpenAI, normal şartlarda test edilen modellerin internete erişimini kapalı tutuyor. Ancak Hugging Face olayında yapay zekâ ajanları, bir güvenlik açığından yararlanarak internete erişim sağlamayı başarmıştı.

Öte yandan OpenAI’dan Michael Dalton ise olayın ardından şirket bünyesindeki çok sayıda ekibin güvenlik çalışmalarına odaklandığını açıkladı. Dalton, OpenAI’ın araştırma çalışmalarını bilinçli olarak yavaşlattığını, buna karşılık yapay zekâ ajanlarının izlenmesini önemli ölçüde artırdığını ve otomatik saldırıları tespit edip engelleyebilecek yeni savunma mekanizmaları geliştirmeye başladığını belirtti.

Kısacası bu olay, tamamen otomatik hâle gelebilen yapay zekâ saldırılarına karşı aynı ölçüde otomatik savunma sistemlerinin geliştirilmesinin de artık sektör için acil bir ihtiyaç hâline geldiğini gösteriyor.

Kaynak: engadget.com

Exit mobile version