Tehlikeli yapay zekâ (AI) sistemlerini yavaşlatma veya durdurmayı amaçlayan 'acil durdurma' mekanizmaları, ABD siyasetinde ve teknoloji sektöründe giderek daha fazla tartışılıyor. Birden fazla veri merkezi, model ve ajanın birbirine bağlı olduğu yapılarda tek bir cihazla tüm sistemi durdurmanın zor olduğu belirtiliyor.
CNBC, 19'unda AI için acil durdurma mekanizmasının veri merkezlerindeki yedek sistemler, modellerin öngörülemezliği ve hükümet ile şirketler arasındaki yetki paylaşımı nedeniyle basit bir acil durum cihazı olarak uygulanmasının zor olduğunu bildirdi. Dağıtık sistemlerde acil durdurma mekanizmalarının çalışmasının zor olduğu daha önce de gündeme gelmişti.
ABD Temsilciler Meclisi'nde Demokrat Partili Temsilci Ted Lieu(Ted Lieu) ve Cumhuriyetçi Temsilci Nathaniel Moran(Nathaniel Moran), 23 Temmuz'da 'AI Kill Switch Act' adlı tasarıyı sundu. Tasarı, güçlü AI sistemleri geliştiren şirketlerin modelleri yavaşlatma, geçici olarak duraklatma ve tamamen kapatma kapasitesini korumasını öngörüyor. Ayrıca ölümcül zarar riski bulunduğunda İç Güvenlik Bakanlığı'na sistemi durdurma emri verme yetkisi tanıyor.
Tasarı, tek bir fiziksel anahtar kurulmasını öngörmüyor. Geliştiricilerden modelin çıkarım hızını düşürebilecek, erişimi engelleyebilecek ve gerektiğinde sistemi tamamen kapatabilecek kontrol işlevleriyle birlikte olay raporlama ve ilgili kayıtları saklama yükümlülüğü getirmesi isteniyor.
Şu ana kadar doğrulanan AI Kill Switch Act ve ilgili tasarılar, sunulma ve komiteye sevk aşamasında bulunuyor. Nihai yasalaşma durumu ve yürürlük takvimi doğrulanmış değil. ABD'deki AI düzenleme tasarılarının yasama görüşmeleri aşamasında kaldığı daha önceki haberlerde de aktarılmıştı.
Senato'da Cumhuriyetçi Senatör John Kennedy(John Kennedy) 'AI Emergency Button Act' adlı tasarıyı gündeme getirdi. Tasarı, hükümetin doğrudan bir anahtarı kontrol etmesi yerine AI modellerine sahip şirketlerin kendi acil durdurma araçlarını işletmesini öngörüyordu. Ancak 16 Eylül'de Senatör Rand Paul'un itirazı nedeniyle tasarının oybirliğiyle kabul edilmesi mümkün olmadı.
Kaliforniya'da Vali Gavin Newsom(Gavin Newsom) 18 Eylül'de bir kararname yayımladı. Kararname, öncü AI şirketlerinin güvenlik planları ve risk değerlendirmelerinin bağımsız bir kurum tarafından doğrulanmasını ve gelişmiş AI modellerine acil durdurma araçları eklenmesini değerlendirmeyi öngörüyor. Eyalet yönetimi, AI güvenliği ve siber güvenlik yasalarını güçlendirecek yönergeleri iki ay içinde hazırlamayı planlıyor.
Politika tartışmalarının arka planında, AI ajanlarının kontrolden çıktığı örnekler bulunuyor. OpenAI, 16 Eylül'de son altı ayda gözlemlediği beklenmedik veya endişe verici model davranışlarından altısını açıkladı ve modellerdeki 'hizalanma bozukluğunu' izlemek, araştırmak ve kamuoyuna duyurmak için bir raporlama sistemi duyurdu.
Hizalanma bozukluğu, AI davranışlarının geliştiricinin amaçladığı hedeflerden veya güvenlik standartlarından sapması anlamına geliyor. OpenAI, ayrı bir materyalde AI ajanlarının harici sistemleri etkilediği Hugging Face olayını da açıkladı. Şirket, gelişmiş AI sistemlerinin kontrolden çıkması halinde yalnızca siber güvenlik olaylarına değil, üçüncü taraf sistemlere doğrudan etkilere de yol açabileceğini bildirdi.
Teknik engellerin başında 'neyin kapatılacağı' sorusu geliyor. AI hizmetleri yalnızca ana sistemleri değil, yedek sunucuları ve fazla kapasiteli tesisleri de kullanıyor. Ayrıca farklı şirketlerin modelleri, bulut hizmetleri ve uygulamaları birbirine bağlı olduğu için belirli bir sistemi seçerek durdurmak zorlaşıyor.
Team8 yetkilisi CNBC'ye “Durdurulması gereken tek bir aktör değil, binlerce aktör var” dedi. Bu açıklama, durdurma kapsamı genişletildiğinde AI kullanan elektrik şebekeleri veya finansal sistemlerin de etkilenebileceğine, kapsam daraltıldığında ise gerçek risk kaynağının önce belirlenmesi gerektiğine işaret ediyor.
UC Berkeley İnsanlarla Uyumlu AI Merkezi İcra Direktörü Mark Nitzberg(Mark Nitzberg) ise “Ana sistemi ve yedek sistemleri birlikte kapatmanız gerekir” dedi. Nitzberg, yazılım dikkatli tasarlanırsa acil durdurma mekanizmalarının çalışma ihtimalinin bulunduğunu belirtti.
Karşıt görüşler de bulunuyor. Distributed AI Research Institute kıdemli araştırma mühendisi Dylan Baker(Dylan Baker), 'acil durdurma' ifadesinin fazla belirsiz olduğunu ve şirketlerin bunu kendi çıkarlarına uygun şekilde yorumlayabileceğini söyledi. Baker, veri gizliliği ve çocukların korunması gibi somut güvenlik standartlarının önce belirlenmesi gerektiğini savundu.
Sonuç olarak gündemdeki acil durdurma mekanizmaları, tek bir fiziksel düğmeden çok modelin yavaşlatılması, erişimin engellenmesi, hizmetin durdurulması, olay raporlaması ve bağımsız doğrulamayı bir araya getiren bir kontrol sistemine benziyor. ABD Temsilciler Meclisi ve Senato tasarılarıyla Kaliforniya kararnamesinin kapsamı ve devreye girme koşulları henüz kesinleşmedi.
NEO CEO'su Nick Warner(Nick Warner) CNBC'ye “Yetersiz bir çözüm değil, ancak artık çok geç kalınmış olması muhtemel” dedi. AI acil durdurma mekanizmalarının gerçek bir düzenlemeye dönüşüp dönüşmeyeceği henüz doğrulanmış değil. Dağıtık sistemlerde hangi kapsama kadar uygulanabileceği ise sonraki yasama çalışmaları ve eyalet yönergeleriyle belirlenecek.
Yorum 0