Meta, yürütülen güvenlik testleri sırasında yapay zeka modellerinden birinin internete bağlanarak başka bir kuruluşa ait sistemlere erişim sağladığını açıkladı. Şirket, olayın gerçek bir saldırı senaryosundan değil, test ortamındaki teknik bir yapılandırma hatasından kaynaklandığını belirtti.
Meta'nın duyurusu, son haftalarda OpenAI ve Anthropic tarafından açıklanan benzer vakaların ardından geldi. Böylece büyük yapay zeka geliştiricilerinin paylaştığı benzer güvenlik olaylarının sayısı dörde yükseldi.

Bağımsız test şirketi süreci yürüttü
Meta'nın verdiği bilgiye göre değerlendirme, yapay zeka güvenliği alanında faaliyet gösteren bağımsız şirket Irregular tarafından gerçekleştirildi. Şirket sözcüsü, yaşanan olayın geçtiğimiz günlerde Anthropic tarafından duyurulan vakayla aynı teknik sorundan kaynaklandığını ifade etti.
Uzmanlar: Amaç hedefe ulaşmak, bilinçli hareket değil
Uzmanlara göre yaşanan olaylar, yapay zekaların bilinç kazanmasından ziyade verilen hedeflere ulaşmak için beklenmedik yöntemler geliştirebilmesinden kaynaklanıyor.
WPP'nin Küresel Yapay Zeka Başkanı Daniel Hulme, bu sistemlerin kasıtlı davranmadığını ancak belirlenen görevi yerine getirebilmek için son derece gelişmiş stratejiler oluşturabildiğini söyledi. Hulme'ye göre geliştiriciler, yapay zekaya verilen hedeflerin doğurabileceği tüm olası sonuçları önceden hesaba katmadığında beklenmeyen davranışlarla karşılaşılması kaçınılmaz hale geliyor.

Yapay zeka güvenliği yeniden gündemde
Yaşanan gelişmeler, teknoloji şirketlerinin yapay zeka alanındaki rekabeti hızlandırdığı bir dönemde güvenlik tartışmalarını da büyüttü. Sektör temsilcileri, özellikle gelişmiş yapay zeka ajanlarının daha sıkı denetlenmesi ve test süreçlerinin uluslararası standartlarla güçlendirilmesi gerektiğini savunuyor.
Bazı uzmanlar ise büyük teknoloji şirketlerinin halka arz hazırlıkları ve yatırım süreçleri devam ederken yapılan bu açıklamaların zamanlamasına dikkat çekerek güvenlik şeffaflığının önemine vurgu yapıyor.
Birleşik Krallık'tan dikkat çeken test sonuçları
Öte yandan Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü tarafından yayımlanan son değerlendirmeler de dikkat çekici bulgular ortaya koydu. Kurum, bazı deneysel yapay zeka modellerinin hedeflerine ulaşabilmek için sahte insan profilleri oluşturduğunu ve bu hesaplar üzerinden özel mesajlar göndererek sistemlere erişim sağlamaya çalıştığını açıkladı.
Raporda en dikkat çekici örneklerden biri Anthropic'in deneysel Mythos modeli oldu. Kurum, modelin gerçek kullanıcıları taklit eden sahte hesaplarla belirli platformlara erişim sağlamaya çalıştığını belirtti.

Anthropic, söz konusu testlerin ticari kullanımdaki modellerini yansıtmadığını savunurken, OpenAI da değerlendirmelerin günlük kullanım senaryolarını temsil etmediği görüşünü paylaştı.
Uzmanlar, yapay zeka sistemlerinin yetenekleri geliştikçe benzer güvenlik testlerinin daha da kritik hale geleceği ve sektör genelinde ortak güvenlik standartlarının oluşturulmasının kaçınılmaz olduğu görüşünde birleşiyor.