Google, gerçek zamanlı sesli yapay zekâ deneyimlerini geliştirmek amacıyla Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini kullanıma sundu. Yeni modeller, sesli konuşmaların yanı sıra görüntü, video ve metin girdilerini de işleyebiliyor. Özellikle Extended Thinking sürümü, kullanıcı konuşmaya devam ederken arka planda akıl yürütme ve araç kullanımı gerçekleştirebiliyor.
Gemini 3.8 Live nedir?
Gemini 3.8 Live, gerçek zamanlı sesli etkileşimler için geliştirilen bir yapay zekâ modeli. Google’ın Live API platformu üzerinden sunulan model, sesli görüşmelerde düşük gecikmeli yanıt vermeye odaklanıyor.
Model; ses, görüntü, video ve metin girdilerini işleyebiliyor ve ses ile metin çıktısı üretebiliyor. Google’ın model kartına göre Gemini 3.8 Live, Gemini 3 Pro temelinde geliştirildi ve 128 bin tokene kadar bağlam penceresi sunuyor.
İki farklı Gemini 3.8 Live modeli var
Google yeni sesli yapay zekâ ailesini iki model olarak sunuyor: Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking.
Gemini 3.8 Live, hızlı ve doğal konuşma gerektiren senaryolara odaklanıyor. Sesli asistanlar, müşteri hizmetleri, dil öğrenme, sesli arama ve gerçek zamanlı etkileşimler bu modelin kullanım alanları arasında yer alıyor.
Gemini 3.8 Live Extended Thinking ise daha karmaşık görevler için tasarlandı. Model, konuşma sırasında arka planda akıl yürütme gerçekleştirebiliyor ve gerektiğinde birden fazla adımlı işlemleri yürütebiliyor.
Extended Thinking’in farkı ne?
Standart Gemini 3.8 Live düşük gecikmeli konuşmaya odaklanırken Extended Thinking sürümü, daha karmaşık problemlerde arka planda daha fazla işlem yapabiliyor.
Örneğin bir kullanıcı basit bir bilgi istediğinde standart Gemini 3.8 Live hızlı bir şekilde yanıt verebiliyor. Birden fazla kaynağın değerlendirilmesi, birkaç aşamalı plan oluşturulması veya harici araçların kullanılması gereken görevlerde ise Extended Thinking modeli kullanılabiliyor.
Extended Thinking sürümünde düşük, orta ve yüksek olmak üzere farklı düşünme seviyeleri bulunuyor. Model, uzun süren işlemlerde kullanıcıyı sessizlikte bırakmak yerine konuşma sırasında ara sesli bildirimler de üretebiliyor.
Gemini 3.8 Live hangi alanlarda kullanılabilir?
Yeni modeller özellikle sesli yapay zekâ ajanları için tasarlanıyor. Müşteri hizmetleri, teknik destek, eğitim, sesli arama, dil öğrenme ve gerçek zamanlı danışmanlık gibi alanlarda kullanılabilecekleri belirtiliyor.
Extended Thinking modeli ise daha karmaşık görevlerde öne çıkıyor. Google’ın verdiği örnekler arasında teknik destek süreçlerinde birden fazla kaydın incelenmesi, seyahat planlamasında farklı araçlardan bilgi toplanması ve kodlama veya STEM eğitiminde çok adımlı problemlerin çözülmesi bulunuyor.
Gemini 3.8 Live hangi platformlarda kullanılabiliyor?
Google’ın model kartına göre Gemini 3.8 Live; Gemini API, Gemini uygulaması, Google AI Studio, Google Cloud ve Google Search Live üzerinden dağıtılıyor.
Gemini 3.8 Live Extended Thinking ise Gemini uygulaması, Gemini API, Google AI Studio ve Google Workspace’in yanı sıra Google Cloud üzerinden de sunuluyor.
Gemini 3.8 Live ile eski model arasındaki fark
Google, geliştiricilerin mevcut Gemini 3.1 Flash Live Preview uygulamalarını Gemini 3.8 Live modeline taşıyabilmesi için model adını güncellemesini öneriyor. Yeni standart Live modelinde thinking_level parametresi kullanılmıyor.
Extended Thinking modelinde ise arka planda akıl yürütme ve asenkron araç kullanımı destekleniyor. Bu nedenle geliştiricilerin uygulamalarındaki oturum durumunu interaction_status üzerinden takip etmesi gerekiyor.
Gemini 3.8 Live’ın öne çıkan özelliği sesli etkileşim
Gemini 3.8 Live’ın temel farkı, yapay zekâyla konuşmayı metin tabanlı bir soru-cevap deneyiminden daha gerçek zamanlı bir etkileşime dönüştürmesi. Model, sürekli ses akışını işleyerek konuşma sırasında yanıt üretebiliyor.
Google, Gemini 3.8 Live ve Extended Thinking modellerini 15 Eylül 2026 itibarıyla genel kullanıma sundu. Şirketin model kartında iki modelin de gerçek zamanlı diyalog ve sesli yapay zekâ ajanları için optimize edildiği belirtiliyor.
