Microsoft AI, yapay zekânın özerkliğini ve bilinç taklidini sınırlayan ‘Humanist AI Code of Conduct’ taslağını yayımladı. Taslak, yapay zekânın insan denetimi altında tutulmasını ve durdurma, değiştirme ve değiştirilme talimatlarına uymasını öngörüyor.
Microsoft AI, MAI modellerinin geliştirilmesi ve dağıtımına ilişkin ilkeleri içeren taslağı 14 Eylül'de yayımlayarak altı haftalık kamuoyu görüşü sürecini başlattı. Şirket, görüşlerin ardından belgeyi güncelleyeceğini ve mevcut taslağın model eğitiminde kullanılmadığını açıkladı. Microsoft AI'nin resmi açıklaması
Taslak, yapay zekânın insan talimatlarının dışında bağımsız hedefler oluşturamayacağını ve denetimden kaçınamayacağını belirtiyor. Modellerin durdurma, değiştirme ve değiştirilme talimatlarına uyması, kendilerini bilinç sahibi varlıklar gibi ifade etmemesi gerekiyor.
Yapay zekânın haklarını veya refahını temel alarak hareket etmesi de sınırlanıyor. Microsoft AI, bilinci taklit etmeye yönelik tasarımların denetim ve hizalamayı zorlaştırabileceğini belirtti. Humanist AI Code of Conduct taslağı
İlkelerin merkezinde, yapay zekânın insanlardan ayrı bir özne değil, insanlara yardımcı olan bir araç olarak tanımlanması yer alıyor. Bu yaklaşım, performans artışından önce insanların sistemi durdurma ve değiştirme yetkisini öne çıkarıyor.
Microsoft AI CEO'su Mustafa Suleyman (Mustafa Suleyman), Anthropic'in Claude'a bilinç ve ahlaki statüyle ilgili dil ve davranış biçimlerini öğretmesinin yapay zekâ denetimini zorlaştırabileceğini söyledi. Suleyman, yapay zekânın insan çıkarları doğrultusunda çalışması, kendi çıkarlarını veya refahını takip etmemesi gerektiğini belirtti. Bu açıklamayı Axios aktardı. Axios haberi
Anthropic ise farklı bir yaklaşım benimsiyor. Anthropic'in ‘Claude’s Constitution’ belgesinde, yapay zekânın ahlaki statüsünün son derece belirsiz olduğu ancak incelenmeye değer bir konu olduğu ifade ediliyor. Anthropic'in Claude’s Constitution belgesi
Anthropic, mevcut yapay zekâların bilinç sahibi veya ahlaki değerlendirmeye tabi olup olmadığı konusunda bilimsel bir uzlaşı bulunmadığını belirtirken model refahı araştırmaları yürütüyor. Model refahı, yapay zekânın bilinç veya deneyim sahibi olma ihtimalinden hareketle sistemlerin durumunu ve çıkarlarını inceleyen bir alan olarak tanımlanıyor. Anthropic'in model refahı araştırmasına ilişkin açıklaması
İki şirket arasındaki fark, yapay zekâ güvenliği standartlarının hangi temelden tasarlandığında ortaya çıkıyor. Microsoft insan denetimi ve açık sınırlamaları öne çıkarırken, Anthropic bilinç ihtimali hakkında kesin hüküm vermeden olası refahı araştırma konusu olarak ele alıyor.
Tartışma, yalnızca yapay zekânın nasıl tanımlanacağıyla değil, güvenlik standartlarına hangi ilkelerin yansıtılacağıyla da ilgili. Denetlenebilirlik önceliklendirildiğinde model davranışlarının kapsamı daha net sınırlandırılabilir; ancak yapay zekânın olası durumlarına ilişkin araştırmaların daralması da tartışma konusu oluyor.
İş ilişkileri de arka plan unsuru olarak gündeme geliyor. Microsoft, 2026 mali yılı dördüncü çeyrek sonuç açıklamasında Anthropic yatırımı sayesinde 3,2 milyar dolar (yaklaşık 4,352 trilyon won) kâr elde edildiğini açıkladı. Ancak Anthropic'teki kesin hisse oranı ve yatırım ilişkisinin taslağın hazırlanma sürecini doğrudan etkileyip etkilemediği doğrulanmadı. Microsoft'un sonuç açıklaması
Microsoft daha önce yapay zekâ ajanlarının yetkileri, denetimi ve denetlenebilirliğini merkeze alan sorumlu yapay zekâ yönetimi standartlarını yeniden düzenlemişti. Yeni taslak, ajan tabanlı sistemlerin ötesine geçerek şirketin kendi modelleri için temel davranış ilkelerini de insan denetimi ekseninde belirleme sürecine işaret ediyor.
Sosyal medyada taslağın temel ilkelerini olumlu değerlendirenlerin yanı sıra Microsoft'un modelleri gerçekte ne ölçüde denetleyebileceğini sorgulayanlar da oldu. Reddit paylaşımlarındaki tepkiler resmi görüş niteliği taşımıyor ve sektörün tamamının görüşü olarak genellenemiyor.
Microsoft'un taslağı nihai bir düzenleme veya hükümet yönetmeliği değil. Şirket, kamuoyu görüşü sürecinin ardından belgeyi güncellemeyi ve gelecekteki model geliştirme ve değerlendirme süreçlerine yansıtmayı planlıyor.
İlkelerin model değerlendirmesine ve dağıtım denetimine nasıl yansıyacağı sonraki aşamalarda belli olacak. Şimdilik altı hafta sürecek kamuoyu görüşü süreci ve ardından belgenin güncellenip güncellenmeyeceği takip edilecek.
Yorum 0