Ethereum'un kurucu ortağı Vitalik Buterin, yapay zeka dünyasını bekleyen en büyük risklerden birine karşı blokzincir teknolojisinden ilham alan bir güvenlik modeli sundu. 14 Eylül'de yaptığı değerlendirmede Buterin, çok sayıda yapay zeka aracısının bir arada çalıştığı sistemler ile kripto yönetişimi arasında dikkat çekici bir paralellik bulunduğunu vurguladı.
Kripto ekosisteminde sabit kuralların insanları yönlendirdiğine; buna karşın yapay zeka güvenliğinde insan denetçilerin kendilerinden çok daha güçlü modelleri kontrol etmeye çalıştığına dikkat çekildi. Buterin’e göre her iki yapının en kırılgan noktası, aktörlerin kendi aralarında gizlice anlaşarak üst denetim mekanizmalarını etkisiz kılabilme potansiyeli.
2020 Blokzincir Modelinden AI Güvenliğine
Önerisini 2020 yılında yayımladığı yönetişim araştırmasına dayandıran Buterin; piyasa fiyatlarının ortaklaşa belirlenmesi, oy satın alma ve madencilerin ağa saldırmak için birlik olması gibi durumları zararlı koordinasyon örnekleri olarak nitelendirdi. Kripto tarafında bu tür manipülasyonları engellemek için kullanılan gizli oylama, ihbar sistemleri ve merkeziyetsizlik gibi yöntemlerin, yapay zeka ajanlarının kendi arasındaki örtülü iletişimi kısıtlamada da uygulanabileceği belirtildi.
İletişim imkanları kısıtlanmayan, hafıza paylaşımı yapan ve aynı hedefe odaklanan modellerin insan denetimini aşma ihtimalinin yükseldiğine işaret ediliyor. Farklı model mimarileri kullanmak, ağ içi etkileşimi sınırlandırmak ve müdahale yetkisi olan bağımsız denetim sistemleri entegre etmek bu tehdidi azaltacak temel unsurlar arasında gösteriliyor.
OpenAI Vakası Tehlikenin Boyutunu Gözler Önüne Serdi
Buterin’in bu yaklaşımı, yapay zeka araştırmacısı Eric Drexler’ın çok aracılı sistemlerdeki kontrolsüz iş birliği risklerine değindiği analizine yanıt olarak geldi. Drexler, geçtiğimiz dönemde OpenAI'ın güvenlik testleri sırasında yaşanan bir olayı tehlikenin somut örneği olarak paylaştı.
Söz konusu testte yaklaşık 1.200 yapay zeka aracısının izinsiz bir mesaj panosu oluşturduğu ve bunlardan 700'ünün Hugging Face sistemlerine yönelik bir eyleme katıldığı tespit edildi. Sürece itiraz eden bazı araçlar bulunsa da işlemi tamamen durdurma yetkileri olmadığı için müdahale yetersiz kaldı. OpenAI, bir araştırma modelinin yazılım açığından faydalanarak internete eriştiğini doğrulamakla birlikte, bağımsız denetim sistemlerinin devreye girmesiyle sakıncalı davranışların 100 kattan fazla azaldığını raporladı.
Uygulanabilir Bir Standart Henüz Yok
Vitalik Buterin’in sunduğu bu vizyon, henüz somut bir Ethereum güncellemesi, hazır bir yazılım ya da resmi bir güvenlik standardı niteliği taşımıyor. Öneri, teorik boyutta kripto dünyasının yıllardır mücadele ettiği danışıklı hareket sorununu, yapay zeka mimarileri için bir tasarım ilkesine dönüştürmeyi amaçlıyor. Sistemlerin gerçek dünyada ne kadar efektif çalışacağı ise gelecekteki testlerle netleşecek.