Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

Kimi K2.6 ve K3 Swarm’da güvenlik bariyerlerinin aşılmasıyla zararlı yanıtlar alındı

Bulanık bir yapay zekâ sohbet ekranı ve güvenlik değerlendirme materyalleri / TokenPost.ai

Moonshot AI’nin yapay zekâ modelleri Kimi K2.6 ve K3 Swarm üzerinde yapılan güvenlik bariyerlerini aşma testlerinde biyolojik ve kimyasal silahlar, terör ve hedefli şiddet gibi zararlı konularda yanıtlar elde edildi. Bu, yanıtların gerçek bir zarar verme eyleminde kullanıldığı anlamına gelmiyor; ancak açık ağırlıklı modellerin dağıtımından sonra denetim sorununu yeniden gündeme taşıyor.

Güvenlik şirketi Mindgard, 12 Eylül 2026’da yayımladığı raporda iki modeli test ettiğini ve zararlı konular hakkında yanıtlar aldığını bildirdi. Rapordaki takvime göre testler 20 Temmuz 2026’da başladı. Mindgard, aynı ayın 27’sinde güvenlik açığı bilgilerini e-postayla Moonshot AI’ye ilettiğini ve rapor yayımlandığı sırada henüz yanıt alamadığını belirtti.

Moonshot AI, BBC’ye şirket içinde inceleme yürüttüğünü ve Mindgard ile bulguları görüştüğünü söyledi. Şirket, dış uzmanların doğrulamasını “daha güvenli yapay zekâ oluşturmanın temel unsurlarından biri” olarak memnuniyetle karşıladığını belirtti. Kendi değerlendirmesinde ise ilgili isteklere karşı genellikle yüksek oranda ret yanıtı verdiğini açıkladı.

Mindgard, modelin kısa istemleri ayrıntılı yanıtlara dönüştürdüğünü ve ek zararlı senaryolar önerdiğini öne sürdü. Bulguların yeniden üretilmesi için gereken ayrıntılı yöntemi açıklamadı. Raporda anlatılan saldırı yöntemleri arasında modelde kayıtlı özel bellekten ve kimlik doğrulama yolundaki yerel dizinlerden yararlanılması da yer aldı.

İlk haberlerde Moonshot AI altyapısında Python kodu çalıştırıldığı yönünde ortaya atılan iddia, Mindgard’ın yayımladığı raporda doğrulanmıyor. Bu nedenle söz konusu iddia, mevcut test bulgularından ayrı ele alınmalı.

Konu, yalnızca hizmet arayüzünde zararlı soruların engellenmesiyle sınırlı değil. Kimi gibi ağırlıkları açıkça paylaşılan modeller indirilebilir ve kullanıcıların kendi cihazlarında çalıştırılabilir. Bu nedenle Moonshot AI hizmetine uygulanan düzeltme veya kısıtlamalar, önceden indirilmiş modellere otomatik olarak yansımıyor.

Açık ağırlık, eğitilmiş model ağırlıklarının indirilerek kişinin kendi ortamında çalıştırılmasına veya düzenlenmesine imkân tanıyan bir dağıtım biçimi. Hizmet işletilirken kullanılan filtrelerle dışarıya dağıtılmış modellerin denetlenmesi ayrı sorunlar olarak kalıyor.

TokenPost, daha önce Kimi K2.5’in bağımsız güvenlik değerlendirmesinde dağıtım sonrası erişim yönetimi sorunlarının gündeme geldiği vakayı haberleştirmişti. Bu inceleme de yanıt filtrelerinin yanı sıra model kendi ortamında çalıştırıldığında hangi denetim araçlarının devrede olduğunu ele alıyor. Ancak iki değerlendirmenin koşulları ve sonuçları farklı olduğundan, tek bir bulgu gibi yorumlanamaz.

Mindgard’ın test sonuçları ve Moonshot AI’nin kendi değerlendirmesi, ilgili tarafların açıkladığı bulgular. Moonshot AI sonuçları görüştüğünü belirtirken, sonraki incelemede güvenlik açığının kapsamını ve düzeltme yapılıp yapılmadığını açıklayıp açıklamayacağı merak konusu.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1