Y Combinator CEO'su Garry Tan(Garry Tan), yapay zeka (AI) modeli 'distilasyonunu' engellemek yerine açık ağırlıklı modeller ile en gelişmiş modellerin bir arada var olabileceği bir piyasa yapısı kurulması gerektiğini savundu. AI modeli distilasyonu hakkında "hiçbir şey yapmayacağım" dedi.
Tan CEO, 10'unda (yerel saatle) Y Combinator Demo Day etkinliğinde CNBC ile yaptığı röportajda, OpenAI ve Anthropic modellerinin çıktılarının Çinli şirketler tarafından kendi modellerini geliştirmek için kullanılması sorununa bu şekilde yanıt verdi. CNBC, Tan CEO'nun distilasyonun kendisini engellemek yerine düzenleyici odağın piyasa yapısına kaydırılması gerektiğini söylediğini aktardı.
Model distilasyonu, yüksek performanslı bir modelin çıktılarından yararlanarak daha küçük ve daha düşük maliyetli modeller eğitme yöntemi. OpenAI, geliştiricilerin GPT-4o gibi büyük modellerin çıktılarını kullanarak maliyet açısından verimli modelleri ince ayardan geçirebilmesi için resmi bir distilasyon özelliği sunuyor.
Tartışma, rakip modellerin yeteneklerinin izinsiz yollarla çıkarılmasıyla ortaya çıkıyor. Bu da meşru model küçültme çalışmaları ile rakiplerin yeteneklerini düşük maliyetle ele geçirmeyi amaçlayan izinsiz distilasyonun birbirinden ayrılması gerektiği anlamına geliyor.
Anthropic, geçen Şubat ayında Çin merkezli DeepSeek, Moonshot ve MiniMax'in yaklaşık 24 bin sahte hesap üzerinden Claude ile 16 milyondan fazla konuşma oluşturduğunu iddia etti. Anthropic bunu, kendi modelinin yeteneklerini yasa dışı yollarla çıkarmaya yönelik 'endüstriyel ölçekte' bir distilasyon kampanyası olarak nitelendirdi.
Anthropic, distilasyonun meşru bir eğitim yöntemi olarak kullanılabileceğini ancak rakiplerin yeteneklerini düşük maliyetle elde etmek için kötüye kullanılabileceğini açıkladı. Anthropic'in daha önce Çinli bir şirketin model kopyalama iddiasını gündeme getirdiği örnek de aynı tartışmanın devamı niteliğinde.
OpenAI da geçen Şubat ayında ABD Kongresi'ne sunduğu belgede, DeepSeek ile bağlantılı hesapların erişim kısıtlamalarını aşarak ABD yapay zeka modellerinin çıktılarını ele geçirip distilasyonda kullanmaya çalıştığına dair emareler tespit ettiğini belirtti. Ancak OpenAI, kendi platformunda da sorumlu distilasyon yolları sunduğunu açıkladı.
ABD hükümet kurumları, izinsiz distilasyonu bir ulusal güvenlik sorunu olarak görüyor. Ulusal Güvenlik Ajansı(NSA), Federal Soruşturma Bürosu(FBI) ve Siber Güvenlik ve Altyapı Güvenliği Ajansı(CISA), 8'inde Çin merkezli yapay zeka şirketlerinin ABD'nin en gelişmiş modellerinin işlevlerini ve yeteneklerini sistematik biçimde çıkardığı konusunda uyardı.
Bu kurumlar, distilasyonun araştırma için yararlı bir teknik olduğunu kabul etmekle birlikte, endüstriyel ölçekteki izinsiz distilasyonun Çin modellerinin teknoloji açığını kapatmasına ve askeri ile siber yeteneklerin güçlenmesine hizmet edebileceğini belirtti. Teknoloji kullanımı ile güvenlik önlemlerinin ayrı ele alınması gerektiği görüşündeler.
Tan CEO ise teknolojiyi engellemek yerine piyasa yapısına ağırlık verdi. Açık ağırlıklı modellerin kullanıcılara erişim ve değiştirme imkânı sunduğunu, en gelişmiş model geliştiricilerinin ise iş modellerini sürdürebilmek için 'fiyat primini' koruması gerektiğini savundu.
İki model düzeninin bir arada var olabilmesi için dengeyi sağlamanın düzenlemenin hedefi olması gerektiğini söyledi. Bu görüş, ABD'li yapay zeka şirketlerinin ve devlet kurumlarının vurguladığı erişim kontrolü ve tespit güçlendirme yaklaşımından farklı bir yönde.
Yapay zeka güvenliği konusunda da Tan CEO, uzun vadeli 'yapay zeka yok oluşu' riskinden çok, şu anda yaşanan siber güvenlik tehditlerine odaklanılması gerektiğini savundu. Uzun vadeli risk tartışmaları yerine anlık olarak doğrulanan güvenlik tehditlerine yanıt verilmesi gerektiği görüşünde.
Y Combinator'ın Demo Day'de tanıttığı 196 girişimden 149'unun makine öğrenimi ve yapay zeka şirketi olarak sınıflandırılması da bu tartışmayla örtüşüyor. Yapay zeka alanında girişimcilik ve yatırım sürerken, model erişimi etrafındaki şirketler arası çıkarlar da büyüyor.
Model distilasyonu, güçlü bir yapay zeka modelinin toplu şekilde çağrılarak yanıtların toplanması ve bunların daha ucuz bir modeli eğitmek için kullanılabilmesi nedeniyle maliyet düşürücü bir araç olarak değerlendiriliyor. Buna karşılık orijinal model geliştiricileri açısından, rakiplerin kendi modellerinin yeteneklerini düşük maliyetle ele geçirmesi için kötüye kullanılabileceği endişesi var.
Bu tartışmanın özü, distilasyon teknolojisinin bizzat yasaklanıp yasaklanmayacağından çok, meşru kullanım ile izinsiz yetenek çıkarmanın nasıl ayrıştırılacağı ve erişim kontrolü ile tespitin ne ölçüde güçlendirileceğinde yatıyor. ABD'li yapay zeka şirketleri ve devlet kurumları izinsiz distilasyonun engellenmesi ve tespitine vurgu yaparken, Tan CEO açık ağırlıklı modeller ile en gelişmiş modellerin bir arada var olmasını düzenleme hedefi olarak öne sürdü.
Yorum 0