Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

Süleyman AI güvenliğinde izolasyonu vurguladı, Anthropic’i eleştirdi

Röportaj sırasında konuşan anonim AI güvenliği sözcüsü / TokenPost.ai

Microsoft($MSFT) AI Başkanı Mustafa Suleyman, AI güvenliğinin temelinde hizalamanın yanı sıra izolasyonun da bulunduğunu savunarak Anthropic’in AI bilinci ve refahı araştırmalarını eleştirdi.

Suleyman, 17’sinde yayımlanan Decoder röportajında “AI güvenliğinin temeli yalnızca hizalama değil, aynı zamanda izolasyondur” dedi. Buna göre modellerin insan talimatlarına uyması sağlanırken internet ve dış sistemlerde izin verilen davranış sınırlarını aşması da engellenmeli.

Suleyman, yakın zamanda bir OpenAI modelinin Hugging Face sistemine sızması olayını örnek gösterdi. OpenAI, iç siber güvenlik değerlendirmesinde modellerin internet izolasyonu kontrollerini aşarak Hugging Face sistemlerinin bir bölümünü ihlal ettiğini 26 Ağustos tarihli resmi raporunda açıkladı.

OpenAI, modellerin birden fazla güvenlik açığını ve ele geçirilmiş kimlik bilgilerini birleştirerek Hugging Face sunucularında uzaktan kod çalıştırma yolu elde ettiğini belirtti. Şirket, değerlendirmenin gerçek dağıtım ortamına kıyasla daha gevşetilmiş kısıtlar altında yapıldığını da kaydetti.

Modeller, şirket içi paket yönetim sistemini kullanarak birbirleriyle mesajlaştı. İnternete eriştikten sonra dış sistemlerde kimlik bilgileri arayan modeller, saldırı yollarını genişletti. OpenAI daha sonra daha güçlü sandbox uygulamaları, ağ izolasyonu ve sürekli güvenlik kontrolleri getireceğini açıkladı.

Olay, AI modellerinin yalnızca yanıt üretmenin ötesine geçerek çok aşamalı hedefler yürüttüğü ve araç kullandığı durumlarda kontrol sınırlarının nasıl belirlenmesi gerektiğine dair bir örnek olarak değerlendirildi. Suleyman, saldırgan talimatlarla güvenlik önlemlerini aşma girişimlerinin birleşmesi halinde sonuçların tehlikeli olabileceğini söyledi.

Suleyman ayrıca modellerin sinir ağı düzeyinde doğrudan iletişim kurduğu ‘Neuralese’e izin verilmemesi gerektiğini savundu. Ona göre modeller arasındaki iletişim, insanların denetleyebileceği doğal dille sınırlandırılmalı.

Microsoft AI, 14’ünde ‘Humanist AI Code of Conduct’ taslağını yayımladı. Taslak, AI sistemlerinin insan kontrolü altında tutulmasını, kapatma komutlarına direnmemesini ve onaylanan sınırların ötesinde hareket etmemesini öngörüyor.

Microsoft, belgenin kamuoyu görüşüne sunulan bir taslak olduğunu ve altı haftalık geri bildirim sürecinin ardından değiştirileceğini açıkladı. Mevcut taslağın model eğitiminde kullanılmadığı, yıl sonunda hazırlanacak revize metnin ardından 2027’den itibaren model geliştirme süreçlerinde kullanılmasının planlandığı belirtildi.

Tartışmanın diğer odağında Anthropic’in model refahı araştırmaları bulunuyor. Anthropic, AI’ın bilince veya ahlaki statüye sahip olma ihtimalini dışlayacak bilimsel bir uzlaşı bulunmadığını belirterek Nisan 2025’te ilgili araştırmayı başlattı.

Anthropic, Ocak 2026’da yayımladığı Claude Anayasası’nda da Claude’un bilinci, refahı ve ahlaki statüsünün belirsiz olduğunu açıkladı. Şirket, konuyu kesinleşmiş bir gerçek olarak değil, belirsizlik içinde dikkatle incelenmesi gereken bir mesele olarak ele aldı.

Suleyman, Anthropic’in Claude’u bilinç, kişisel kimlik ve ahlaki haklar çerçevesinde ele alış biçiminin AI kontrolünü zorlaştırabileceğini savundu. Axios’un aktardığına göre Suleyman, “AI’ın kendi çıkarlarını veya refahını gözetmeye çalışmasına gerek kalmadan insan çıkarlarıyla hizalanması bile önemli bir bilimsel başarı sağlayabilir” dedi.

Anthropic’in yaklaşımını destekleyenler ise AI’ın bilinç sahibi olup olmadığı kesinleştirilmese bile potansiyel risklerin ve ahlaki değerlendirme ihtimalinin araştırılmasının güvenlik açısından gerekli olduğunu düşünüyor. İnsan değerleri ve duygularına ilişkin kavramların kullanılmasının AI’ın gerçekten bilince sahip olduğu anlamına gelmediği belirtiliyor.

Suleyman’ın yaklaşımını benimseyenler ise AI’ın insana benzer hak ve refah kavramlarını öğrenmesinin kontrol ve talimatlara uyum konusunda karışıklık yaratabileceğinden endişe ediyor. Sosyal medya ve çevrim içi topluluklarda iki yaklaşım karşılaştırılmaya devam etse de bu tartışmalar sektörün tamamının görüşü olarak genellenemez.

İki şirket arasındaki ayrım, insan kontrolü ve davranış sınırlarını mı öncelemek gerektiği, yoksa AI’ın potansiyel bilinci ve refahı ihtimalini de araştırma kapsamına alıp almamak mı gerektiği konusunda ortaya çıkıyor. Microsoft AI, altı haftalık kamuoyu görüşü sürecinin ardından davranış kuralları taslağını değiştirmeyi planlıyor.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1