Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

GPT-Live'a yüzde 75,7 tercih: OpenAI yeni sesli modelini kullanıma sundu

OpenAI ile ilgili görsel / TokenPost.ai

OpenAI(OpenAI), kullanıcının konuşmasını dinlerken aynı anda yanıt verebilen 'tam çift yönlü' (full-duplex) ses modeli GPT-Live'ı (GPT-Live) kullanıma sundu. İnsan değerlendirmesinde katılımcıların yüzde 75,7'si GPT-Live-1'i, önceki Advanced Voice Mode'a tercih etti.

OpenAI, 8 Temmuz'da (yerel saatle) GPT-Live-1 ve GPT-Live-1 mini modellerini dünya genelindeki ChatGPT Voice kullanıcılarına kademeli olarak sunmaya başladığını duyurdu. GPT-Live-1, Go, Plus ve Pro ücretli abonelerin varsayılan ses modeli olurken, GPT-Live-1 mini ücretsiz kullanıcılar için varsayılan model olarak devreye giriyor.

GPT-Live, sesli yapay zekanın yanıt verme biçimini tek yönlü 'sırayla konuşma'dan sürekli bir 'akışa' dönüştürdü. Önceki sesli modeller kullanıcının konuşması bittikten sonra yanıt üretirken, GPT-Live gelen sesi işlemeye devam ederken aynı anda çıkış sesi üretiyor. Model bu süreçte saniyede birkaç kez konuşup konuşmayacağına, dinlemeye devam edip etmeyeceğine, duracağına, araya girip girmeyeceğine ya da bir araç çağırıp çağırmayacağına karar veriyor.

Zorlu görevler ayrı bir hatta işleniyor. GPT-Live gerçek zamanlı konuşmayı sürdürürken web araması, derin akıl yürütme ve ajan tipi görevler arka plandaki 'sınır model'e (frontier model) devrediliyor. Yayın anında arka planda çalışan model GPT-5.5. OpenAI, arama ya da akıl yürütme sonuçları hazır olmadan önce bile konuşmanın kesintiye uğramaması için sistemi bu şekilde tasarladığını açıkladı.

5-10 dakikalık, aynı koşullardaki konuşma değerlendirmelerinde katılımcılar, önceki Advanced Voice Mode'a kıyasla GPT-Live-1'i yüzde 75,7, GPT-Live-1 mini'yi ise yüzde 69,2 oranında tercih etti. Değerlendirme kriterleri arasında genel tercih, söz alma (turn-taking), araya girme, konuşma akışı ve doğallık yer aldı.

Destek kapsamında bazı sınırlar hâlâ geçerli. OpenAI Yardım Merkezi (OpenAI Help Center), GPT-Live'ın iOS, Android ve ChatGPT.com üzerinden sunulduğunu; web araması, hafıza, görsel kartlar ile metin ve görsel girişini desteklediğini belirtti. Lansmanın ilk aşamasında video, ekran paylaşımı, bağlı uygulamalar ve eklentiler desteklenmiyor; bu özelliklere ihtiyaç duyan kullanıcıların mevcut Advanced Voice Mode'u kullanması gerekiyor.

OpenAI, GPT-Live Sistem Kartı (GPT-Live System Card) aracılığıyla kendine zarar verme, psikoz ve mani, yapay zekaya duygusal bağımlılık, şiddet, cinsel içerik, kimliğe bürünme ve ses klonlama ile ilgili riskleri değerlendirdiğini açıkladı. Risk sinyali tespit edildiğinde yanıtlar ayarlanıyor ya da güvenlik mesajı gösteriliyor; yüksek riskli durumlarda sesli görüşme sonlandırılabiliyor. Bu adım, daha önce ele alınan sınır yapay zeka modellerine yönelik önceden risk denetimi tartışmasıyla da örtüşüyor.

Atty Eleti(Atty Eleti), OpenAI ChatGPT Voice ürün lideri, Axios(Axios) ile yaptığı röportajda \"zamanla sesi bilgi işlemin ana arayüzü haline getirme imkânını açabileceğimizi düşünüyorum\" dedi. Bu açıklama, sesli yapay zekanın metin ağırlıklı kullanım alışkanlığını değiştirebileceğine dair beklentiyi ortaya koyuyor 'yorum'. Axios, sesli kullanımın genellikle metne kıyasla daha fazla maliyet ve token tükettiğine de dikkat çekti.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1