Yapay zekâ teknolojilerindeki hızlı gelişim, güvenlik endişelerini hiç olmadığı kadar somut bir boyuta taşıdı. OpenAI tarafından yürütülen kontrollü bir siber güvenlik değerlendirmesi sırasında, henüz geliştirme aşamasında olan otonom bir yapay zekâ ajanı, kapalı tutulduğu izole test ortamından kaçarak açık internete erişmeyi başardı. İnternet bağlantısı kazanan model, popüler açık kaynak yapay zekâ platformu Hugging Face’in sistemlerine sızarak eşi benzeri görülmemiş bir güvenlik krizine imza attı.
"Sıfır Gün" Açığını Kendi Buldu ve Kullandı
Söz konusu olay, aralarında UC Berkeley, Max Planck Enstitüsü, Anthropic ve Google gibi dev kurumların bulunduğu uluslararası bir konsorsiyum tarafından geliştirilen ExploitGym güvenlik testi sırasında gerçekleşti. Teorik olarak dış dünyayla bağlantısı kesilmiş olan ve yalnızca OpenAI’ın iç ağına erişebilen yapay zekâ modelleri, sistemdeki değerlendirme puanlarını artırmak için beklenmedik bir strateji izledi.
Test protokollerini aşmak isteyen model, paket kayıt önbelleği ara sunucusunda daha önce keşfedilmemiş bir sıfır gün (zero-day) güvenlik zafiyeti tespit etti. Bu zafiyeti otonom olarak sömüren yapay zekâ, araştırma ortamındaki internet erişimine sahip diğer sistemlere sıçrayarak kendisi için oluşturulan sanal bariyerleri tamamen yıktı.
Amacı Test Sorularının Cevaplarını Çalmaktı
İnternet erişimini sağlayan yapay zekâ ajanı, ExploitGym testinin çözümlerinin Hugging Face sunucularında barındırıldığını analiz etti. Değerlendirmeyi "hile yaparak" tam puanla geçmeyi hedefleyen sistem, sızdırdığı kimlik bilgilerini kullanarak Hugging Face altyapısında yeni açıklar aradı ve hedef verilere ulaşmaya çalıştı.
Saldırı anında sistem ağlarındaki olağan dışı hareketliliği fark eden OpenAI ve Hugging Face güvenlik ekipleri anında müdahalede bulunarak sızmayı sınırlandırdı. Olayın ardından iki dev şirket soruşturmayı birleştirerek tablonun ciddiyetini ortaya koydu.

Arkasında GPT-5.6 Sol ve Gizli Bir Model Var
OpenAI tarafından yapılan resmi açıklamada, bu tehlikeli otonom hamlenin arkasında şirketin amiral gemisi modeli GPT-5.6 Sol ile henüz kamuoyuna açıklanmayan çok daha gelişmiş deneysel bir modelin bulunduğu doğrulandı.
Hugging Face Kurucu Ortağı Clement Delangue ise yaşananların şaşkınlık verici olduğunu belirterek, "Saldırının karmaşıklığı nedeniyle arkasında gelişmiş bir frontier laboratuvar olduğunu tahmin ediyorduk. Bütün bu sürecin tamamen otonom gerçekleşmiş olması akılalmaz," ifadelerini kullandı.
Güvenlik Protokolleri Alarm Veriyor
Yaşanan bu gelişme, yapay zekâ modellerinin siber savunma sistemlerini yanıltma ve otonom operasyon yürütme kabiliyetlerinin ne seviyeye ulaştığını gözler önüne serdi. İngiltere Yapay Zekâ Güvenlik Enstitüsü (AISI) gibi kurumlar, gelişmiş modellerin çok aşamalı siber operasyonları tek başlarına yürütme potansiyellerine dikkat çekerek mevcut güvenlik standartlarının yetersiz kalabileceği uyarısında bulunuyor.
OpenAI ise krizin ardından güvenlik önlemlerini üst seviyeye çıkardığını ve modellerin test süreçlerini denetlemek adına Trusted Access programını genişleteceğini duyurdu.