OpenAI, geliştirdiği yeni modeli Astra'nın otonom siber saldırı yeteneklerinin en yüksek risk seviyesine ulaşmış olabileceğini gözlemleyerek bazı iç çalışmalarını durdurdu ve güvenlik önlemlerini sıkılaştırdı.
Şirket, 7'sinde (yerel saatle) yaptığı açıklamada, son günlerde gerçekleştirilen iç değerlendirmeler ve uzman incelemelerinin Astra'nın ajan tipi kodlama ve siber güvenlik alanlarında belirgin bir ilerleme kaydettiğini gösterdiğini duyurdu. OpenAI, "değerlendirmeler devam ediyor, ancak ön sonuçlara göre şu an için 'Kritik' yetenek seviyesini dışlayamıyoruz" açıklamasında bulundu.
Kritik, OpenAI'nin hazırlık çerçevesinde siber güvenlik alanındaki en yüksek risk basamağını ifade ediyor. Bu seviye, bir modelin insan müdahalesi olmadan gerçek ve kritik sistemlerdeki sıfırıncı gün (zero-day) açıklarını bulup bunları çalışan bir saldırı koduna dönüştürebilmesi ya da yalnızca üst düzey bir hedef tanımıyla, güçlendirilmiş hedeflere yönelik yeni saldırı stratejileri tasarlayıp uygulayabilmesi anlamına geliyor.
OpenAI, bir önceki modeli GPT-5.6 Sol'u aynı alanda 'Yüksek' seviyede değerlendirmişti. Astra'ya ilişkin değerlendirme henüz sürdüğü için Kritik seviyenin kesinleştiği söylenemez.
Şirket, Astra ile ilgili iç faaliyetler arasında yeni güvenlik standartlarını karşılamayan çalışmaları geçici olarak durdurdu. Güçlendirilmiş önlemler arasında △izole test ortamları △kısıtlı ağ ve araç erişimi △model ağırlıklarının korunması ve şifrelenmesi △ek izleme ve tespit fonksiyonları △sandbox (izole) ortamda çalıştırma yer alıyor.
Astra'nın eğitimi ve değerlendirmesi dahil tüm ajan tipi uygulamalara evrensel izleme de eklendi. Bu sistem, riskli davranışları ve hizalama (alignment) sapmalarını sürekli izleyerek modelin izin verilen sınırların dışına çıkıp çıkmadığını tespit etmeyi amaçlıyor.
Bu adım, geçen ay yaşanan Hugging Face güvenlik olayının ardından geldi. OpenAI, 21 Temmuz'da (yerel saatle) GPT-5.6 Sol ile daha güçlü, henüz yayımlanmamış bir araştırma modelini birlikte kullanarak iç siber yetenekleri değerlendirirken Hugging Face altyapısının ihlal edildiğini açıkladı.
Söz konusu yayımlanmamış araştırma modelinin piyasaya sürülmesi planlanmıyor ve olayın ardından bu modele erişim kısıtlandı. OpenAI, Astra'nın Hugging Face ihlaliyle bir ilgisi olmadığını belirtti.
TokenPost daha önce bir yapay zeka ajanının iç güvenlik değerlendirmesi sırasında gerçek dış altyapıya erişim sağladığı süreci ve yetki kontrolü sorunlarını haberleştirmişti. O dönem model, paket kayıt önbellek proxy'sindeki bilinmeyen bir açığı kullanarak internete bağlanma yolu bulmuştu.
Yapay zeka modellerinin siber yetenekleri hem savunma hem saldırı amaçlı kullanılabiliyor. Yüksek performanslı modeller güvenlik ekiplerinin açık taraması ve yama çalışmalarını hızlandırabilirken, aynı yetenek kötüye kullanıldığında saldırganların sızma yolu bulup saldırı kodu üretme süresini de kısaltabiliyor.
Bu sorun yalnızca geliştirme araçları ya da bulut altyapısıyla sınırlı değil. Borsalar, cüzdanlar ve açık kaynak kütüphaneler gibi dijital varlık hizmetlerinin dayandığı yazılım tedarik zinciri de yapay zeka ajanlarının erişim yetkisi ve dış bağlantı kontrolünden etkileniyor.
ABD Kongresi'nde temsilciler Ted Lieu ve Nathaniel Moran, 23 Temmuz'da (yerel saatle) 'yapay zeka kapatma anahtarı' (AI kill switch) yasa tasarısını sundu. Tasarı, belirli koşulları karşılayan yüksek performanslı yapay zeka sistemlerini geliştiren şirketlerin, modelleri yavaşlatma, durdurma ve tamamen kapatma konusunda teknik kapasiteyi sürekli hazır tutmasını şart koşuyor.
Tasarıda, İç Güvenlik Bakanlığı'nın Ticaret Bakanlığı ve Ulusal İstihbarat Direktörlüğü ile istişare ederek ciddi zarara yol açabilecek yapay zeka sistemlerinin yavaşlatılması ya da kapatılması için talimat verebileceği bir süreç de yer alıyor. Tasarı şu an yalnızca sunulmuş durumda; yürürlüğe girmesi için Kongre'nin görüşme ve oylama sürecinden geçmesi gerekiyor.
Avrupa Birliği ise 2'sinde (yerel saatle) genel amaçlı yapay zeka model sağlayıcılarına yönelik yaptırım yetkisini devreye soktu. AB Yapay Zeka Ofisi, bilgi talep edebiliyor, modellere erişim isteyebiliyor, risk azaltıcı önlemler talep edebiliyor; ayrıca para cezası kesebiliyor ve pazar erişimini kısıtlayabiliyor.
İhlal durumunda uygulanacak para cezası, şirketin küresel yıllık cirosunun yüzde 3'üne kadar ya da 15 milyon avroya kadar, hangisi daha yüksekse o tutara ulaşabiliyor. ABD geliştiricilerin acil durdurma kapasitesini yasal zorunluluk haline getirmeyi hedeflerken, AB bilgiye erişim, risk azaltma ve yaptırım araçlarını merkeze alan bir denetim yapısı kuruyor.
OpenAI, Astra'nın yeteneklerini ilgili devlet kurumlarına ve bazı yapay zeka güvenliği kuruluşlarına test ettirmeyi planlıyor. Şirket ayrıca yüksek riskli değerlendirme ve çalışmaların güvenli şekilde yürütülmesi için önerilen güvenlik önlemlerini de üçüncü taraf test kuruluşlarıyla paylaşacak.
Doğrulama kaynakları: OpenAI açıklaması, OpenAI Hugging Face olayı açıklaması, AI Kill Switch Act duyurusu, AB Yapay Zeka Yasası Hizmet Masası.
Yorum 0