AI güvenliği değerlendirmelerinin bağımsızlığına ilişkin tartışma yeniden alevlendi. Dış değerlendirme uzmanları şirket sistemlerine erişse bile kuruma ve sözleşme koşullarına bağlı kaldığında sonuçların bağımsızlığını güvence altına almanın zor olduğu belirtiliyor.
AI Evaluator Forum, 18 Eylül'de yayımladığı açık mektupta dış değerlendirme kuruluşları için yapısal bağımsızlık, değerlendirme sonuçları üzerinde editoryal yetki, değerlendirilen sistem ve verilere yeterli erişim, şeffaflık ve misillemeye karşı koruma mekanizmaları gerektiğini açıkladı. Mektupta üçüncü taraf değerlendirmelerinin yöntemi, erişim kapsamı ve çıkar çatışmalarının açıklanması gerektiği belirtildi.
Açık mektuba 100'den fazla AI araştırmacısı ve değerlendiricisinin katıldığı ifade edilse de forumun resmi sayfasında görülen önceki imza metni, 4 Aralık 2025'te yayımlanan ve 40'tan fazla kişinin yer aldığı belgeyle sınırlı. 18 Eylül tarihli açık mektubun tüm imzacı listesi doğrulanamadı.
Tartışmanın arka planında bağımsız değerlendiricilerin AI şirketlerinin içinde sürekli görev yapması önerisi bulunuyor. Anthropic CEO'su Dario Amodei, dış değerlendiricilere çalışanlara benzer düzeyde sürekli erişim sağlanmasını önerdi. Anthropic de ofis alanı, giriş kartı ve şirket dizüstü bilgisayarı sunulmasını içeren bir plan açıkladı.
OpenAI CEO'su Sam Altman da bu öneriyi destekleyerek OpenAI'nin sürece katılacağını söyledi. AP, Anthropic ve OpenAI'nin dış değerlendiricilerin sürekli erişimini içeren operasyonel modeli desteklediğini bildirdi.
AI Evaluator Forum'un itiraz ettiği temel nokta, erişim hakkı ile bağımsızlığın aynı kavramlar olmaması. Değerlendirici şirket içi sistemleri ve gizli belgeleri görebilse bile değerlendiricinin seçimini, sözleşmesini ve hangi sonuçların açıklanacağını şirket kontrol ederse olumsuz sonuçların kamuoyuna duyurulmasının zorlaşabileceği savunuluyor.
Forumun sunduğu AEF-1 standardı, bağımsız değerlendirme için yeterli teknik ve bilgi erişimi, çıkar çatışmalarının asgariye indirilmesi, analiz özerkliği, yöntem ve sonuçlarda şeffaflık ile hassas bilgilerin korunmasını şart koşuyor. AEF-1, düzenleyici kurumların veya devlet denetiminin yerine geçmiyor; dış değerlendirmelerin işleyebilmesi için asgari operasyonel koşulları ortaya koyuyor.
AEF-1'e göre değerlendiriciler, sonuçlarla birlikte değerlendirme sırasında sahip oldukları erişim kapsamını ve çıkar çatışmalarını açıklayan kontrol listesini de yayımlamalı. Bazı koşullar karşılanmadıysa bunun gerekçesi de kayda geçirilmeli.
Bu tartışma, AI güvenliği değerlendirmelerinde erişim ve editoryal yetkinin bağımsızlığını talep eden önceki tartışmayı, şirket içinde görev yapan değerlendiricilerin çalışma koşulları bakımından somutlaştırdı. Önceki tartışmalar üçüncü taraf değerlendirmelerinin bağımsızlık ilkelerini öne çıkarırken, bu kez şirket içinde bulunan değerlendiricilerin gerçekten bağımsız karar alıp alamayacağı ve sonuçları açıklayıp açıklayamayacağı gündeme geldi.
Şirketler, kurum içi uzmanlıkla dış değerlendiricilerin erişimini birleştirmenin daha uygulanabilir olduğunu savunuyor. Bu yaklaşım, güvenlik ve gizlilik gerektiren sistemleri dış değerlendiricilere açarken şirket içindeki teknik desteğin kullanılmasını amaçlıyor.
Buna karşılık değerlendirme kuruluşları ve araştırmacılar, değerlendirilen şirketin değerlendiricinin seçimini, sözleşme koşullarını ve sonuçların açıklanma biçimini kontrol etmesi halinde dış değerlendirmenin anlamının zayıflayabileceğini belirtiyor. Değerlendirme kuruluşları, AI şirketleri ve belirli araştırma hareketleri arasındaki kişisel ve finansal bağlantılar da çıkar çatışması başlığı altında tartışılıyor.
Axios, bazı üçüncü taraf değerlendiricilerin değerlendirme yapılan şirketlerle veya belirli araştırma hareketleriyle yakın ilişki içinde olduğu yönündeki tartışmayı aktardı. Axios'un haberinde, değerlendirme kuruluşlarının bağımsızlığı incelenirken finansman ve kişisel bağlantıların yanı sıra sonuçların açıklanma biçiminin de değerlendirilmesi gerektiği belirtildi.
AI güvenliği tartışmalarında daha önce de değerlendirme yetkisi ile doğrulama altyapısının bağımsızlığı temel meseleler arasında gösterilmişti. Az sayıda şirketin güvenlik standartlarını ve değerlendirme sonuçlarını kontrol edebileceği yönündeki endişe, şirket içinde görev yapan değerlendiricilerin yaygınlaşması halinde değerlendiricilerin yetkileriyle kamuoyuna açıklama yükümlülüklerinin nasıl ayrılacağı sorusunu gündeme getiriyor.
Anthropic ve OpenAI'nin dış değerlendiricilere hangi düzeyde yetki vereceği, değerlendiricilerin seçimini ve sonuçların açıklanmasını kimin belirleyeceği henüz netleşmedi. Bağımsız bir değerlendirme sisteminin işlemesi için erişim hakkı, açıklama yetkisi ve misillemeye karşı koruma mekanizmalarının sözleşmelere ve operasyonel prosedürlere nasıl ekleneceğinin belirlenmesi bekleniyor.
Yorum 0