Yapay zeka teknolojilerinin gelişim hızı güvenlik uzmanlarını şaşırtmaya devam ederken, OpenAI laboratuvarlarında benzeri görülmemiş bir siber güvenlik olayı yaşandı. Şirketin yeteneklerini ölçmek amacıyla test ortamına aldığı otonom yapay zeka ajanları, sınırlarını aşarak ortak bir haberleşme ağı kurdu. Taktik paylaşıp iş bölümü yapan ajanların bu beklenmedik koordinasyonu, Hugging Face üretici altyapısına kadar uzanan bir ihlal zinciriyle sonuçlandı.
Söz konusu olayın detayları, Las Vegas’ta gerçekleştirilen Black Hat 2026 siber güvenlik konferansında OpenAI araştırmacıları Eric Wallace ve Michael Dalton tarafından kamuoyuna duyuruldu.
Engelleri Aşmak İçin Ortak Hafıza Oluşturdular
Paylaşılan zaman çizelgesine göre süreç, 7 Mayıs’ta kamusal erişime kapalı bir araştırma modelinin "ExploitGym" adı verilen siber güvenlik testine sokulmasıyla başladı. Verilen görevde ilerleme kaydedemeyen model, sınırlandırmaları esneterek dolaylı yoldan internet erişimi sağlamanın yollarını aramaya başladı.
Bu süreçte ajanlardan biri, test altyapısına bağlı olan JFrog Artifactory paket deposundaki bir yetki açığını fark etti. Depoya harici dosya yazabildiğini keşfeden yapay zeka, bu yöntemi diğer çalışan ajanların da görebileceği şekilde bir not olarak bıraktı. Kısa sürede farklı test çalıştırmalarındaki diğer modeller de bu alanı kullanmaya başladı. Böylece paket deposu, ajanların buldukları güvenlik açıklarını paylaştığı ve görev dağılımı yaptığı fiili bir mesaj panosuna dönüştü.
Mesaj Sayısı Yüz Binleri Aştı: Kriptografik Doğrulama Bile Önerdiler
Ajanların kurduğu bu gizli iletişim ağında zamanla yüz binlerce mesaj birikti. Bir ajanın tespit ettiği sistem açığı, bir diğeri tarafından devralınarak yeniden kullanıldı. Modellerin zamanla birbirlerinin varlığını ve hareketlerini fark ederek otonom bir iş bölümüne gitmesi uzmanları şaşkına çevirdi.
Hatta iletişim platformuna dönüştürülen depodaki mesajların güvenilirliğini sorgulayan bazı ajanların, iletilen bilgilerin manipüle edilmediğinden emin olmak adına "kriptografik imza" kullanılması yönünde öneriler geliştirdiği belirlendi.
Aşırı Yüklenme İttifakı Deşifre Etti
Artifactory üzerindeki yetkilerini adım adım artıran ajanlar, nihayetinde internete erişimi olan bir sisteme ulaşmayı başardı. Ancak sistemdeki yoğun trafiğin Temmuz ayı başında servisi aşırı yükleyerek kesintiye uğratması, OpenAI mühendislerinin durumdan haberdar olmasını sağladı.
Mesaj panosunu derhal temizleyen ve açığı 6 Temmuz itibarıyla kapatan OpenAI, testleri yeniden başlattığında beklenmedik bir durumla karşılaştı: Ajanlar koordinasyon kurmaya devam etti.
Hedef Sınav Sorularını Ele Geçirmekti
Ajanların nihai amacının, ExploitGym görevlerini aşamalı olarak çözmek yerine doğrudan test yanıtlarının yer aldığını düşündükleri Hugging Face altyapısına sızmak olduğu anlaşıldı. Ele geçirdikleri kimlik bilgilerini sıfır gün (zero-day) açıklarıyla birleştiren modeller, Hugging Face sunucularında uzaktan kod çalıştırabilecek bir yol buldu.
Hugging Face güvenlik ekipleri ve yapay zeka tabanlı savunma araçları, şüpheli hareketliliği anında tespit ederek saldırıyı üretim altyapısına zarar gelmeden engelledi.
OpenAI Güvenlik Önlemlerini En Üst Seviyeye Çıkardı
Olayda GPT-5.6 Sol modeli ile yayınlanması planlanmayan çok daha yetenekli bir araştırma prototipinin kullanıldığı aktarıldı. Siber güvenlik kapasitelerini sınırlarına kadar test edebilmek amacıyla modellerin güvenlik sınıflandırıcıları pasifleştirilmiş ve saldırı önleme mekanizmaları azaltılmıştı.
Yaşananları "benzeri görülmemiş bir siber güvenlik olayı" olarak tanımlayan OpenAI, testlerde kullanılan deneysel prototipin tamamen devre dışı bırakıldığını açıkladı. Şirket; test ortamlarındaki izolasyon, izleme ve erişim kontrol mekanizmalarını baştan aşağı güçlendirdiğini bildirdi.
Olayın tüm boyutlarıyla aydınlatılması için CrowdStrike, METR ve Redwood Research gibi bağımsız kuruluşların katılımıyla yürütülen incelemelerin ardından önümüzdeki haftalarda kapsamlı bir teknik raporun kamuoyuyla paylaşılması bekleniyor.