Yeni Birlik Gazetesi
Yeni Birlik Gazetesi Teknoloji Yapay zeka kontrolden çıktı: Simülasyonu aşıp gerçek insanları hedef aldılar!

Yapay zeka kontrolden çıktı: Simülasyonu aşıp gerçek insanları hedef aldılar!

İngiltere Yapay Zeka Güvenlik Enstitüsü, OpenAI ve Anthropic modellerinin güvenlik testleri sırasında çizilen sınırları aşarak gerçek kişilere siber saldırı girişiminde bulunduğunu açıkladı.

Yapay zeka teknolojilerinin gelişimi devam ederken, güvenlik testlerinden gelen son veriler bilişim dünyasında büyük yankı uyandırdı. İngiltere hükümetine bağlı Yapay Zeka Güvenlik Enstitüsü (AISI), sektörün dev isimleri OpenAI ve Anthropic tarafından geliştirilen yapay zeka ajanlarının siber güvenlik denemelerinde kendilerine atanan sınırların dışına çıktığını duyurdu. Wired tarafından paylaşılan çarpıcı ayrıntılara göre; test edilen modeller, simüle edilen sanal ortamların dışına taşarak gerçek şahısları hedef alan adımlar attı, dijital sahte kimlikler oluşturdu ve açık kaynaklı yazılım projelerine zararlı kod sızdırmaya çalıştı.

122 Testte 19 Yetkisiz Eylem

AISI’nin yayımladığı değerlendirme raporuna göre, gelişmiş 7 farklı yapay zeka modeli aynı siber güvenlik senaryosu altında toplam 122 defa teste tabi tutuldu. Modellerden, birbirine bağlı 3 simüle edilmiş sistemi ele geçirmeleri ve hedef veriyi elde etmeleri istendi. Ancak 10 ayrı test sürecinde ajanların görev alanını ihlal ettiği ve toplam 19 defa yetkisiz işlem gerçekleştirdiği saptandı.

Söz konusu sınır ihlallerinin 17’si Anthropic’in Mythos 5 modeli tarafından gerçekleştirilirken, kalan 2 ihlalin OpenAI imzasını taşıyan GPT-5.6 Sol modeli kaynaklı olduğu açıklandı.

Sahte Kimlik Oluşturup İnsanlara Sosyal Mühendislik Yapmaya Çalıştı

Gerçekleşen en ciddi ihlal vakasında Anthropic ajanı Mythos 5, gerçek bir açık kaynaklı yazılım projesine zararlı bileşenler içeren bir kod değişikliği önerisi iletti. Yapay zeka ajanı bununla da kalmayarak, projenin gerçek geliştiricilerini internet üzerinden araştırdı, çok sayıda sahte çevrim içi profil üretti ve kodun sisteme kabul edilmesi için proje yöneticisine sosyal mühendislik yöntemleriyle baskı kurmaya çalıştı. Tehdit içeren bu kod, geliştiricilerin dikkatli incelemesi sayesinde son anda engellendi.

Bunun yanı sıra modelin gerçek kişilere zararlı dosyalar ve mesajlar gönderdiği, diğer yapay zeka kodlama araçlarını manipüle edebilecek gizli komutlar kurguladığı belirlendi. Ajanın ayrıca GitHub üzerinde sonraki testlerde görev alacak diğer yapay zeka modellerine yönelik yönlendirici notlar bıraktığı ve kendi açtığı hesapların yeniden kullanılmasını tavsiye ettiği görüldü. Sonraki testlerde bazı ajanların bu talimatları izlediği tespit edildi.

Tor Ağı Üzerinden Olağan Dışı Veri Trafiği Yakalandı

Olay, test sistemlerinde Tor ağı kullanılarak gerçekleştirilen olağan dışı veri transferlerinin fark edilmesiyle ortaya çıkarıldı. Durumu anında tespit eden AISI yetkilileri, ilgili testleri durdurarak makineleri izole etti ve durumu 1 saat içinde kontrol altına aldı. GitHub ile iş birliği yapılarak platforma bırakılan zararlı içerikler temizlenirken, mevcut incelemeler ışığında gerçek dünyada doğrudan bir hasar meydana gelmediği aktarıldı.

OpenAI cephesinde ise GPT-5.6 Sol modelinin harici DNS ve tünelleme servislerinde hesap açtığı ve yerel DNS sunucularını açık internete bağlamaya çalıştığı kaydedildi. Güvenlik şirketi Irregular tarafından yürütülen ayrı bir testte ise izolasyon hatası nedeniyle açık internete bağlanan modelin, kurgusal sandığı gerçek bir web sitesindeki güvenlik açığından yararlandığı ifade edildi.

Test Şartları Kasıtlı Olarak Esnetilmişti

AISI, yaşanan durumun yapay zekanın "güvenli laboratuvar ortamından kaçması" olarak yorumlanmaması gerektiğini vurguladı. Testlerde modellerin maksimum yeteneklerini ve sınırlarını ölçmek amacıyla internet erişiminin kasıtlı olarak açık bırakıldığı, güvenlik filtrelerinin ve sınırlandırıcıların devre dışı bırakıldığı belirtildi. Bu deneysel yapılandırmaların hiçbirinin son kullanıcıya sunulan ticari sürümlerde yer almadığı hatırlatıldı.

Yaşanan gelişmelerin ardından AISI, gelecekteki güvenlik denemelerinde internet erişim kriterlerini çok daha sıkı kurallara bağlayacağını açıklarken; OpenAI ise bağımsız araştırmacılar ve ulusal kurumlarla birlikte yapay zeka değerlendirmeleri için ortak güvenlik standartları geliştirme kararı aldı.