Back to top
  • 공유 Paylaş
  • 인쇄 Yazdır
  • 글자크기 Yazı tipi Boyutu
URL kopyalandı.

Google DeepMind, sesli yapay zeka modeli Gemini 3.8 Live'ı tanıttı

Kamerayla takvimi göstererek görüşme yapan akıllı telefon / TokenPost.ai

Google DeepMind, gerçek zamanlı sesli görüşme, görsel bilgi anlama ve karmaşık akıl yürütme özellikleri sunan Gemini 3.8 Live ile Gemini 3.8 Live Extended Thinking modellerini tanıttı.

Gemini 3.8 Live, maliyet verimliliği ve büyük ölçekli işleme odaklanan bir ses arayüzü modeli olarak geliştirildi. Model, gerçeğe yakın zamanlı görüşme ve akıl yürütmenin yanı sıra yalnızca sesli girdileri değil, görüşme sırasında paylaşılan görsel bilgileri de anlayabiliyor.

Google DeepMind, resmi Gemini Audio sayfasında yeni modelin görsel girdileri görüşme bağlamına dahil ederek yanıt verebildiğini açıkladı. Böylece ses odaklı yapay zeka arayüzü, ekran ve kamera içeriğini de anlayacak şekilde genişletildi.

Gemini 3.8 Live Extended Thinking ise karmaşık akıl yürütme ve çok aşamalı görevlerin yürütülmesine odaklanıyor. Tanıtılan kullanım örnekleri arasında, birden fazla ajana arka plandaki görevleri dağıtırken doğal sesli görüşmeyi sürdürmek de yer aldı.

Geliştiriciler, iki modeli Google AI Studio ve Gemini Live API üzerinden test ederek sesli ve görüntülü etkileşim özellikleri geliştirebilecek. Ses çıktılarında Google'ın sentetik içerik tanımlama teknolojisi SynthID kullanılacak.

Google DeepMind, SynthID aracılığıyla Google yapay zekasıyla oluşturulan veya düzenlenen seslerin tanımlanabileceğini açıkladı. Ancak bağımsız benchmark verileri, dış değerlendirme sonuçları, yanıt gecikmesi ve kullanım maliyetleri kamuya açık materyallerde yer almadı.

Google, sesli yapay zekayı sohbet araçlarından görev yürüten araçlara doğru genişletiyor. 26 Ağustos'ta tanıtılan Gemini Live güncellemesinde, sesli komutlarla Gmail ve Calendar bilgilerinin özetlenmesi, e-postaların aranması, sınıflandırılması ve arşivlenmesi özellikleri sunulmuştu. Şirket o dönemde Gemini kullanıcılarının %63'ünün hizmeti sesli kullandığını açıklamıştı.

Türkiye'deki kullanıcılar açısından ses tanıma ve çok dilli işlem kapasitesi öne çıkan başlıklar arasında bulunuyor. Daha önce Google'ın ses-metin yapay zeka modelinin Koreceyi desteklediğinin resmi belgelerde doğrulandığını bildiren TokenPost'un haberinin ardından, yeni modelin Korece görüşme kalitesi ve fiili kullanım kapsamı takip edilecek.

Gemini 3.8 Live'ın tanıtımının Google'ın yapay zeka rekabetçiliğinde nasıl bir değişim yaratacağı; gerçek kullanım, yanıt gecikmesi, maliyet ve güvenlik değerlendirmelerine bağlı olacak. Google DeepMind, modeli geliştirici araçlarıyla birlikte sunmayı planlıyor.

Kripto para ve blockchain alanlarına yönelik doğrudan kullanım örnekleri veya piyasa etkisi açıklanmadı. Sesli yapay zekanın görsel anlama ve ajan tabanlı görev işlemeye genişlediği doğrulanırken, ilgili sektörlerle bağlantının yeni duyurular ve dış değerlendirmelerle netleşmesi bekleniyor.

<Telif hakkı ⓒ TokenPost, yetkisiz çoğaltma ve yeniden dağıtım yasaktır >

Popüler

Diğer ilgili makaleler

Yorum 0

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.

0/1000

Yorum ipuçları

Harika bir makale. Takip talep etme. Mükemmel bir analiz.
1