OpenAI(OpenAI)'ın dış sözleşmeli çalışanlara gerçek ChatGPT kullanıcı sohbetlerini okutup yanıt kalitesini değerlendirttiği ortaya çıktı. Sözleşmeli çalışanlar kullanıcı istemlerini ve ChatGPT yanıtlarını inceledi; kişisel verilerin kullanıcıya nasıl bildirildiği konusu tartışma yarattı.
14'ünde (yerel saatle), 404 Media'ye göre, OpenAI'ın iç kılavuzlara, Slack kanallarına ve gerçek kullanıcı istemlerine dayanan 'Project Lily' adlı proje kapsamında yüzlerce sözleşmeli çalışan işe aldığı bildirildi. Çalışanların kullanıcı sorularının amacını özetledikten sonra ChatGPT'nin ürettiği birden fazla yanıtı okuyup 1 ile 7 arasında puanladığı aktarıldı.
Değerlendirme kriterleri arasında ChatGPT'nin aşırı insansı bir tavır sergilemesini ya da kullanıcıya gereğinden fazla onay vermesini azaltmaya yönelik maddeler de yer aldı. Ancak projenin hangi modeli kapsadığı açıklanmadı.
Sözleşmeli çalışanların Crossing Hurdles ve Mercor üzerinden işe alındığı öğrenildi. 404 Media'nin ulaştığı bir çalışan saatte 50 doların üzerinde ücret aldığını söyledi; ancak toplam çalışan sayısı ve ücretlendirme sistemi paylaşılmadı.
OpenAI, konuşmalar sözleşmeli çalışanlara ulaşmadan önce isim, adres, e-posta, telefon numarası ve hesap numarası gibi kişisel verileri tespit edip kaldıran 'Privacy Filter' uyguladığını açıklıyor. Privacy Filter, kişisel veri anonimleştirme aracının ya da düzenleyici uyum sertifikasyonunun yerini tutmuyor.
OpenAI, Privacy Filter'a ilişkin resmi açıklamasında aracın nadir görülen kimlik belirteçlerini ya da belirsiz kişisel bilgileri gözden kaçırabileceğini belirtti. Hukuk, sağlık ve finans gibi hassas alanlarda insan incelemesi ve ayrı değerlendirme gerektiğini de ekledi.
İsim ya da hesap bilgileri silinse de sohbetin bağlamından kullanıcının kim olduğu tahmin edilebiliyor. Meslek, yaşanılan yer, olayın gelişimi ve aile ilişkileri gibi birden fazla bilginin birleşmesi belirli bir kişinin tespit edilmesine yol açabiliyor.
OpenAI, hizmet güvenliğini ve kullanım koşullarına aykırılığı kontrol etmek için otomatik sistemleri ve insan incelemesini birlikte kullandığını daha önce de açıklamıştı. Ancak güvenlik ihlali içeriğini tespit etme süreciyle, modelin üslubunu, doğruluğunu ve aşırı onaylayıcı eğilimini iyileştirmeye yönelik sözleşmeli çalışan incelemesi farklı amaçlara hizmet ediyor.
404 Media, OpenAI'a kullanıcılara insan tarafından prompt incelemesi ihtimalinin açıkça bildirilip bildirilmediğini sordu, ancak OpenAI bu soruya doğrudan yanıt vermedi. Haberde öne çıkan asıl tartışma, insan incelemesinin varlığından çok kapsamı ve bildirim şekli.
Bireysel kullanıcılar ayarlardan 'Improve the model for everyone' seçeneğini kapatarak yeni sohbetlerin model geliştirmede kullanılmasını engelleyebiliyor. OpenAI'ın veri yönetimi kılavuzuna göre, Temporary Chat modeli geliştirmede kullanılmıyor ve 30 gün sonra siliniyor; ancak güvenlik amaçlı sınırlı inceleme ihtimali yine de sürüyor.
'Improve the model for everyone' ayarının kapatılmasının geçmiş sohbetlere geriye dönük uygulanıp uygulanmadığı ayrıca doğrulanmalı. 404 Media, bu ayarın geçmiş sohbetlere geriye dönük uygulanmadığını aktardı; OpenAI'ın yardım sayfası ise ayar değişikliğinden sonraki yeni sohbetlere ilişkin işleme ilkesini açıklıyor.
Kurumsal ChatGPT Business, Enterprise ve Edu hesaplarında sohbetler varsayılan olarak model eğitiminde kullanılmıyor. OpenAI, kurumsal kişisel veri açıklamasında güvenlik, kötüye kullanım soruşturması ve yasal uyum amacıyla yetkili çalışanların ya da uzman dış sözleşmeli çalışanların sohbetlere sınırlı erişim sağlayabileceğini belirtiyor.
Michal Luria(Michal Luria) Demokrasi ve Teknoloji Politikası Merkezi araştırmacısı, insan incelemesinin karmaşık sohbet botu davranışlarını iyileştirmek için gerekli olabileceğini değerlendirirken, sohbet arayüzünün kullanıcıya gerçekte olduğundan daha güçlü bir mahremiyet hissi verebileceğine dikkat çekti. Bu da incelemenin gerekliliği ile kullanıcı beklentisi arasında bir açık olduğu anlamına geliyor.
Sarah T. Roberts(Sarah T. Roberts) UCLA öğretim üyesi, insan incelemecilerin yapay zeka hizmetlerindeki rolünün hafife alındığını söyledi. Reddit kullanıcıları ise kişisel veri filtresinin sınırlarını ve sözleşmeli çalışan incelemesi konusunda önceden bilgilendirme eksikliğini eleştirdi; ancak topluluk tepkileri bağımsız bir olgu kanıtı olarak değerlendirilemez.
Haber, ChatGPT sohbetlerinin model geliştirmede kullanılabileceğine dair mevcut politikadan çok, gerçek insanların kullanıcı sohbetlerini ne ölçüde okuduğunu ve bu durumun kullanıcıya ne kadar açık şekilde iletildiğini öne çıkardı. Kullanıcıların hesap türüne ve veri ayarlarına göre yeni ve mevcut sohbetlerin işlenme koşullarını ayrı ayrı kontrol etmesi gerekiyor.
Yorum 0