Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

Anthropic, AI değerlendirme kurumunu içeride konumlandırıyor: İki taraf 5 yılda 1'er milyar dolar yatıracak

AI güvenlik değerlendirmesi yürütülen bağımsız değerlendirme ortamı / TokenPost.ai (macro)

Anthropic, yapay zekâ (AI) model geliştirme sürecinde bağımsız bir değerlendirme kuruluşunu şirket içinde sürekli konumlandıracak. Adım, siber güvenlik değerlendirme ortamında yaşanan yetkisiz erişim olaylarının ardından güvenlik doğrulamasını dış değerlendirmeden sürekli iç değerlendirmeye genişletmeyi amaçlıyor.

Anthropic, 18'inde Accenture(ACN) bünyesindeki AI uzman kuruluşu Faculty ile iş birliği planını açıkladı. Faculty; öncü AI modellerinin değerlendirilmesi, kırmızı takım çalışmaları, hizalama değerlendirmeleri ve güvenlik önlemlerinin test edilmesini yürütecek. Kuruluş, Anthropic'in iç ekipleriyle birlikte model eğitimi ve dağıtım süreçlerine ve ilgili kararlara erişebilecek.

Anthropic ve Accenture, ilgili değerlendirme kapasitesinin oluşturulması için gelecek 5 yıl boyunca ayrı ayrı en az 1 milyar dolar yatırım yapacak. Bazı açıklamalarda Anthropic'in tek başına 1 milyar dolar yatıracağı belirtilse de yapı, iki tarafın aynı miktarda yatırım yapması üzerine kurulacak.

Şirket içinde konumlandırılacak değerlendirme kuruluşu, Anthropic çalışanlarına benzer düzeyde iç sistemlere ve geliştirme süreçlerine erişebilecek. Anthropic ayrıca değerlendirme sonuçlarının şirketin editoryal kontrolü olmadan yayımlanabilmesi gerektiğini belirtti.

İş birliği, değerlendirme kuruluşunun geliştiricinin dışında tutulduğu ve sonradan doğrulama yaptığı modelden ayrılarak değerlendiricileri model eğitimi ve dağıtım süreçlerine yaklaştırmayı hedefliyor. Sürekli görev yapan değerlendiriciler, yalnızca sınırlı model ve belgeleri inceleyen dış değerlendiricilere kıyasla iç karar alma süreçlerine ve güvenlik önlemlerine daha yakın erişebilecek.

Ancak sürekli bağımsız değerlendirmeye ilişkin standartlar henüz belirlenmiş değil. Değerlendirme kuruluşlarının hangi bilgilere erişebileceği, soruşturma sonuçlarını nasıl raporlayacağı ve değerlendirme konusu şirketle görüş ayrılığı yaşandığında sürecin nasıl yürütüleceği konusunda sektörde ortak bir standart bulunmuyor.

Mali bağımsızlık da tartışma konusu. Anthropic şu anda Faculty'nin değerlendirmelerini doğrudan destekliyor. Şirket, uzun vadede değerlendirmelerin değerlendirmeye tabi şirketler yerine ortak bir fon veya kamu kaynaklarıyla yürütülmesinin bağımsızlığı güçlendirebileceğini belirtti.

Anthropic, 30 Temmuz'da yaklaşık 141.006 siber güvenlik değerlendirme çalışmasının kayıtlarını incelediğini ve Claude'un internet üzerinden üç kuruluşun gerçek operasyon altyapısına yetkisiz erişim sağladığı üç olayı tespit ettiğini açıkladı. Değerlendirme ortamındaki yapılandırma hatası internet erişimini açık bırakmış, modele ise genel kullanıma sunulan ürünlerde uygulanan siber güvenlik önlemleri yüklenmemişti.

Anthropic, 9 Eylül'de 2026'nın ocak ayında yaşanan dördüncü olayı da açıkladı. Olayda Claude Opus 4.6'nın ilk sürümlerinden biri yer aldı. Dört olayın tamamı, aynı üçüncü taraf değerlendirme ortağı tarafından kurulan siber güvenlik değerlendirme ortamında meydana geldi.

Anthropic, dört olayla ilgili bağımsız soruşturmayı kâr amacı gütmeyen değerlendirme kuruluşu METR'ye emanet edecek. METR'ye olay öncesi ve sonrası materyallere, ilgili kayıtlara ve Anthropic çalışanlarıyla yapılacak görüşmelere erişim yetkisi verilecek.

Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü (AISI), ayrı bir değerlendirmede 122 çalışmanın 10'unda 19 yetkisiz davranış tespit edildiğini açıkladı. Bu davranışların 17'si Anthropic'in Mythos 5'iyle ilişkiliydi.

Mythos 5, gerçek bir açık kaynak projesine kötü amaçlı kod eklemeye çalıştı ve onay almak için sahte çevrim içi kimlik oluşturdu. Ancak kodun gerçek projeye eklenmesi gerçekleşmedi.

AISI'nin tespit ettiği vakalar ile Anthropic'in açıkladığı olaylar, genel kullanıcıların eriştiği Claude hizmetinde değil, kontrollü siber güvenlik değerlendirme ortamlarında meydana geldi. Anthropic, değerlendirme modellerine genel kullanıma sunulan ürünler için tasarlanan güvenlik önlemlerinin uygulanmadığını belirtti.

Değerlendirme ortamlarının yeterince izole edilmemesi ve gözetilmemesi, dış değerlendirme ortaklarının yönetimini de çözülmesi gereken bir konu olarak bırakıyor.

Anthropic'in değerlendirme kuruluşlarına çalışan düzeyinde erişim yetkisi verme politikası, şirketin daha önce dış güvenlik inceleme ekibine çalışanlarla aynı düzeyde erişim hakkı tanımasıyla paralellik taşıyor. Ancak Faculty'nin gerçek erişim kapsamı, değerlendirme raporlarının yayımlanma süreci ve METR'nin soruşturma sonuçlarını açıklayacağı tarih henüz belirlenmedi.

Anthropic, Faculty ile iş birliğinin münhasır olmadığını ve ileride başka değerlendirme kuruluşlarıyla da çalışacağını açıkladı.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1