Yapay Zeka

Google, gerçek zamana yakın akıl yürütebilen yeni Gemini 3.8 Live'ı tanıttı

Google, sesli yapay zeka modelleri arasına bir yenisini daha ekleyerek yeni Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini tanıttı.

Google, gerçek zamana yakın akıl yürütebilen yeni Gemini 3.8 Live'ı tanıttı

Google, sesli yapay zeka modelleri arasında gecikmeyi azaltmayı hedefleyen Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini tanıttı. Yeni modeller, kullanıcıyla konuşmayı sürdürürken arka planda araç ve API çağrıları yapabiliyor. Böylece görevler tamamlanırken sesli iletişimin kesilmemesi hedefleniyor.

Google'ın aktardığı bilgilere göre yeni model, öncelikli olarak ölçeklenebilirliği ve maliyet verimliliğini hedefliyor. Extended Thinking versiyonu ise daha karmaşık görevler ve çok adımlı akıl yürütme süreçleri için geliştirilmiş durumda. Model, konuşmayı ve akıl yürütmeyi eş zamanlı sürdürebilirken arka planda gerçekleştirilen işlemlerin ilerleyişini de kullanıcıya sesli olarak aktarabiliyor.

Yeni modellerin dikkat çeken özelliklerinden biri de geniş dil desteği. Gemini 3.8 Live modelleri, 97 dilde konuşmayı anlama ve ses üretme yeteneğine sahip. Modeller, konuşma sırasında kullanılan dili otomatik olarak algılayarak farklı diller arasında geçiş yapabiliyor. Bunun yanı sıra görsel girdiler de gerçek zamana yakın şekilde işlenebiliyor ve elde edilen görsel bağlam sesli yanıtların oluşturulmasında kullanılabiliyor.

Google'ın paylaştığı demolar, modellerin farklı kullanım senaryolarındaki yeteneklerini ortaya koyuyor. Standart Gemini 3.8 Live, görsel bağlamdan yararlanarak çalışanların işe uyum sürecindeki sorularını yanıtlayabiliyor ve satranç oynayabiliyor.

Extended Thinking sürümü ise taslak çizimleri ve anlık geri bildirimleri çalışan React bileşenlerine dönüştürebiliyor. Model ayrıca birden fazla aşamadan oluşan rezervasyon işlemlerini, kullanıcıyla konuşmayı sürdürerek yönetebiliyor.

Google’ın paylaştığı test sonuçlarına göre Extended Thinking, Artificial Analysis’in Speech to Speech Quality Index değerlendirmesinde 82,6 puan aldı. Şirket, bu sonuçla modelin GPT-Live-1-Astra ve Grok Voice Think Fast 2.0’ın önünde yer aldığını belirtiyor. Standart Gemini 3.8 Live ise Speech Agent Arena’da ikinci sırada konumlandı.

Google, gerçek zamana yakın akıl yürütebilen yeni Gemini 3.8 Live'ı tanıttı

Her iki model de Gemini API ve Google AI Studio üzerinden kullanıma sunulmaya başladı. Kurumsal kullanıcılar Gemini Enterprise üzerinden özel ön izleme kapsamında modellere erişebiliyor. Standart model Search Live’a, Extended Thinking ise Gemini Live’a geliyor.

Extended Thinking’in Workspace kapsamındaki erişimi Docs’ta Google AI Pro ve Ultra aboneleriyle, Gmail ve Keep’te ise tüm Google AI aboneleriyle sınırlı değil. Modeller tarafından üretilen seslere ayrıca yapay zeka içeriklerinin tespit edilmesini sağlayan SynthID filigranı ekleniyor.

Fiyatlandırmada standart model için ses girdisi dakika başına 0,005 dolar, ses çıktısı ise 0,018 dolar olarak açıklandı. Extended Thinking sürümünde ise akıl yürütme token’ları ile video ve belge gibi ek girdiler ayrıca ücretlendiriliyor.

Paylaş