Vitalik Buterin, birden fazla yapay zeka (AI) modelinin etkileşim içinde bulunduğu ortamlarda, modeller arasındaki gizli işbirliğini (collusion) sınırlayan bir yönetişim tasarımının AI güvenliğine uygulanabileceğini belirtti. Wu Blockchain, 14'ünde Vitalik Buterin'in bu görüşü dile getirdiğini bildirdi. Buradaki amaç, AI güvenliğinin yalnızca tek tek modellerin performansı veya talimatlarıyla değil, modeller arasındaki ilişkiler ve işleyiş kurallarıyla birlikte ele alınması gerektiğidir.
Vitalik Buterin, geleneksel yönetişim ile AI güvenliğinin benzer yapısal sorunlara sahip olduğunu açıkladı. Ona göre iki alanın ortak noktası, daha az yeteneğe sahip bir öznenin, kendisinden daha güçlü birden fazla temsilciden istediği sonucu elde etmek zorunda olmasıdır.
Geleneksel yönetişimde özne statik bir algoritma, temsilci ise insan iken; AI güvenliği ortamında özne insan ya da görece daha zayıf bir büyük dil modeli (LLM) olur, daha güçlü LLM ise temsilci rolünü üstlenir.
Buterin'in öne sürdüğü kilit değişken, temsilciler arasındaki işbirliğidir. Temsilcilerin bilgi paylaşarak veya birlikte hareket ederek dışarıdan gelen kontrolü aşma olasılığı sınırlandırılabilirse sistemin genellikle daha iyi sonuçlar elde edebileceğini, bu sonucun AI güvenliğine de uygulanabileceğini açıkladı.
Bu durum, tek bir AI modelinin güvenlik ayarlamasının, birden fazla model birlikte çalıştığında ortaya çıkan riskleri yeterince ele almakta yetersiz kalabileceği anlamına geliyor. Mantık, yalnızca modellerin bireysel davranışlarının değil, aralarındaki etkileşim biçiminin ve yetki dağılımının da ayrıca yönetilmesi gerektiği yönünde.
Vitalik, AI'yı kontrol etme biçiminin de yalnızca teknik araçlara bırakılmaması gerektiğini düşünüyor. Gelecekteki AI kısıtlamalarının basit bir teknik 'kum havuzu' (sandbox) olmaktan çıkıp kurallar, yetkiler, karar mekanizmaları ve kayıt sistemlerini içeren kurumsal bir yapıya yaklaşabileceğini belirtti.
Sandbox, AI'nın erişebileceği kaynakları ve çalışma ortamını sınırlayan teknik bir kontrol yöntemidir. Buterin, buna ek olarak kimin hangi yetkiyle ne yaptığının izlenmesi ve bir sorun ortaya çıktığında karar ile sorumluluğun kayıt altına alınmasını sağlayacak bir sürecin eklenmesi gerektiğini açıkladı.
Bu tür bir yapıda, AI modellerinin güvenliğinin yalnızca dağıtım öncesi değerlendirmeyle belirlenmesi zordur. Bu da fiili işleyiş sürecinde modeller arasındaki etkileşimin izlenmesi ve kural ihlali veya işbirliği şüphesi durumlarına müdahale edecek bir sistemin gerekli olduğu şeklinde yorumlanıyor.
Ancak bu açıklama, belirli bir yönetişim tasarımının AI güvenliğini garanti ettiği iddiası değil, yalnızca uygulanabilirliğine dair bir görüştür. Somut kurallar, yetki yapısı, karar merci veya kayıt yöntemi konusunda herhangi bir detay sunulmadı.
Bu açıklamada blok zinciri sektörüyle doğrudan bağlantılı bir takvim veya iş planı da yer almadı. Açıklamanın odağı Ethereum(ETH) veya kripto para fiyatları değil, çoklu AI modelleri arasındaki işbirliği riski ve kontrol yapısıydı.
Yorum 0