Microsoft(MSFT), büyük yapay zeka (AI) laboratuvarları arasında güvenlik konusunda ortak çalışma önerdi ve kendi AI model geliştirme ilkelerini içeren bir davranış kuralları yayımladı. Ortak değerlendirme sistemi, katılımcı şirketler ve anlaşma takvimi henüz belirlenmedi.
Mustafa Süleyman(Mustafa Suleyman) Microsoft AI CEO'su, 14'ünde Fortune'a verdiği röportajda "Koordinasyon zamanı geldi" dedi. Süleyman'ın önerisi, AI laboratuvarlarının modellerinin performansını ve risk düzeyini bağımsız üçüncü taraflara açarak güvenliği birlikte denetlemesini amaçlıyor.
Süleyman, tarafsız bir üçüncü tarafın seçilmesi, değerlendiricilerin şirket içi erişim kapsamı, değerlendirmenin ne zaman yapılacağı ve düzenleyici kurumlarla koordinasyonun çözülmesi gereken sorunlar arasında olduğunu belirtti. Ortak çalışmanın kapsamı ve değerlendirme sonuçlarının nasıl paylaşılacağı da henüz netleşmedi.
Microsoft'un yayımladığı 'Humanist AI' davranış kuralları, AI modellerinin insanlar tarafından durdurulmasına, değiştirilmesine, yeniden yönlendirilmesine ya da kapatılmasına karşı direnmemesi gerektiğini belirtiyor. Modelin kendi hedeflerini belirlemesi ya da davranış kurallarını ihlal etmeden yapılamayacak görevleri üstlenmesi de yasaklanan davranışlar arasında.
Kurallara göre AI, insanla eşit haklara sahip bir varlık değil, insana yardımcı olan bir araç olarak tasarlanmalı. Modelin duygu, bilinç ya da içsel bir motivasyona sahipmiş gibi davranması da sınırlandırılan konular arasında yer alıyor.
Kimyasal, biyolojik ve nükleer silah geliştirme, saldırgan siber saldırılar, geniş çaplı kamuoyu manipülasyonu, çocuk istismarı, rıza dışı deepfake içerik üretimi ve kendine zarar verme desteği yasaklanan kullanımlar arasında sınıflandırıldı. Microsoft, bu ilkeleri kendi AI modellerinin geliştirilmesinde uygulamayı planlıyor.
Microsoft, davranış kurallarını önümüzdeki altı hafta boyunca kamuoyu görüşüne açacak. Şirket, güncellenen ilkelerin 2027'den itibaren model geliştirme sürecine rehberlik edeceğini ve bunun AI'ın genel yeteneklerini, özerkliğini ve kapasitesini bir ölçüde sınırlayabileceğini açıkladı.
Bu davranış kuralları, birden fazla şirketin katıldığı sektörel bir anlaşmadan çok, Microsoft'un kendi modelleri için belirlediği kontrol ilkelerine odaklanıyor. Azure üzerinden sunulan üçüncü taraf modellere ve müşteri modellerine aynı standartların uygulanıp uygulanmayacağı henüz belirlenmedi.
Anthropic CEO'su Dario Amodei(Dario Amodei), 12'sinde bağımsız değerlendiricilere şirket çalışanlarına benzer sürekli erişim hakkı verilmesini ve AI geliştirme hızının yavaşlatılmasını önerdi. Değerlendiricilere ofis masası, giriş yetkisi ve şirket dizüstü bilgisayarı sağlanması da öneriler arasında yer aldı.
Amodei'nin planı üç aşamalı: geliştirme sürecine bağımsız değerlendiricilerin sürekli yerleştirilmesi, demokratik ülkelerdeki AI şirketleri arasında ortak güvenlik standartlarının oluşturulması ve bunun otoriter rejimleri de kapsayacak şekilde uluslararası koordinasyona genişletilmesi. Anthropic'in şu an için kendi başına taahhüt ettiği tek adım, bağımsız değerlendirici uygulamasını devreye almak.
OpenAI CEO'su Sam Altman(Sam Altman), Fortune'a verdiği röportajda AI güvenlik standartlarının model yeteneklerindeki gelişim hızına yetişemediğini söyledi ve diğer laboratuvarlarla iş birliği yapabileceklerinin sinyalini verdi. Katılımcı şirketler, anlaşma takvimi ve değerlendirme kriterleri henüz açıklanmadı.
ABD ile Çin arasında AI güvenliği konusunda iş birliği yapılabileceği yönünde görüşler de dile getirildi, ancak iki ülkenin ortaklaşa uygulayacağı bir doğrulama sistemi henüz belirlenmedi. ABD-Çin diyaloğunda AI kaynaklı siber saldırıların izlenmesi ve laboratuvarlar arası bilgi paylaşımının gündeme gelebileceği ifade edildi.
Fortune, AI şirketleri arasındaki geliştirme hızı koordinasyonunun ABD'nin tekelcilik karşıtı (antitröst) yasalarıyla çelişebileceğini ve devlet desteğine ihtiyaç duyulabileceğini aktardı. Uluslararası iş birliğinde ülkelerin bilgiye erişim kapsamı da tartışmaya açık bir konu olarak kalıyor.
Bu açıklamanın kripto para ve blok zinciri sektörü ya da yarı iletken tedarik zinciriyle doğrudan bir bağlantısı bulunmuyor. AI model güvenliği ile bulut ve bilgi işlem altyapısı arasında dolaylı bir ilişki olsa da, belirli bir kripto para birimine ya da yarı iletken şirketine etkisi ortaya konmadı.
Şu an için kesinleşen tek adım, Microsoft'un davranış kuralları için altı hafta boyunca kamuoyu görüşü toplaması ve 2027'den itibaren güncellenen ilkeleri kendi model geliştirme standardı olarak kullanmayı planlaması. Sektörün tamamını kapsayan resmi bir anlaşma ya da ortak değerlendirme sistemi henüz öneri aşamasında.
Yorum 0