
Google, sesli yapay zekâ tarafındaki iddiasını yükselten iki yeni modeli duyurdu. Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking, gerçek zamanlı sesli etkileşimleri daha doğal hâle getirmeyi ve karmaşık görevleri konuşma akışını mümkün olduğunca kesmeden gerçekleştirmeyi hedefliyor.
Şirket, 15 Eylül 2026 tarihli duyurusunda ikiliyi bugüne kadarki en gelişmiş canlı diyalog modelleri olarak tanımlıyor. Duyuru, Gemini Audio ekibi adına Tom Ouyang ve Malini Jaganathan imzasını taşıyor.
İki Model, İki Ayrı Kullanım Senaryosu
Gemini 3.8 Live, ölçek ve maliyet verimliliği gözetilerek hazırlandı; akıcı diyalog ile görsel bağlam anlayışını bir arada sunuyor. Gemini 3.8 Live Extended Thinking ise çok adımlı akıl yürütme gerektiren, yüksek karmaşıklıktaki görevler için konumlandırılıyor.
Standart model, görsel girdileri gerçek zamana yakın biçimde işleyerek konuşmaya bağlam ekliyor. Desteklenen 97 dil arasında konuşma sırasında otomatik geçiş yapabiliyor ve araç ile API çağrılarını arka planda çalıştırırken sohbeti sürdürebiliyor.
“Bir Bakayım” Diyen Yapay Zekâ
Extended Thinking sürümünün en dikkat çeken tarafı, akıl yürütme ile konuşmayı eş zamanlı yürütebilmesi. Google, modelin taleplere doğal biçimde karşılık vermek için “Bir bakayım…” benzeri erken sözlü işaretler kullandığını, çok adımlı arka plan görevlerinde ise ilerlemeyi sesli olarak aktarabildiğini belirtiyor. Amaç basit: işlem sürerken sohbetin kopmaması.
Teknik tarafta bu yapının da bir karşılığı var. Extended Thinking, arka planda akıl yürütme gerçekleştirirken eşzamansız fonksiyon çağrılarını kullanıyor. Model, işlem devam ederken ara sesli yanıtlar verebiliyor ve görev tamamlandığında nihai yanıtını sunabiliyor.
Extended Thinking sürümünde fonksiyon çağrılarının eşzamansız (NON_BLOCKING) olarak tanımlanması gerekiyor; bloklayan (BLOCKING) araç çağrıları desteklenmiyor. Model girdi olarak metin, görsel, ses ve video kabul ederken çıktı olarak metin ve ses üretebiliyor.
Test Sonuçları Ne Söylüyor?
Google’ın paylaştığı değerlendirmelere göre Gemini 3.8 Live Extended Thinking, Artificial Analysis’in Speech to Speech Quality Index sıralamasında 82,6 puanla genel sıralamada ilk sırada yer aldı.
Model, ajan tabanlı görev tamamlama tarafında τ-Voice testinde yüzde 68,6, Sierra’nın τ-Voice-banking testinde ise yüzde 35,1 sonuç elde etti. Big Bench Audio değerlendirmesinde yüzde 97,7 skor açıklanırken Gemini 3.8 Live, Speech Agent Arena sıralamasında ikinci sırada yer aldı.
Bu sonuçların Google’ın model duyurusunda paylaştığı değerlendirmelere dayandığını belirtmek gerekiyor. Dolayısıyla farklı test koşulları ve bağımsız değerlendirmeler modellerin gerçek kullanım performansına ilişkin daha kapsamlı bir tablo ortaya koyabilir.
Güvenlik Tarafında SynthID Filigranı
Sesli modellerde dikkat çeken başlıklardan biri de üretilen içeriğin ayırt edilebilirliği. Google, yapay zekâ ürünleri tarafından üretilen seslerin SynthID ile filigranlandığını açıkladı.
Şirkete göre insan kulağı tarafından fark edilmesi amaçlanmayan bu filigran doğrudan ses çıktısına işleniyor ve yapay zekâ tarafından oluşturulan içeriğin tespit edilebilir kalmasına yardımcı oluyor.
Gerçek zamanlı ve doğal konuşabilen yapay zekâ modellerinin yaygınlaşmasıyla birlikte, yapay zekâ tarafından üretilen seslerin tespit edilebilirliğini sağlayan bu tür işaretleme mekanizmalarının önemi de artıyor.
Kimler Kullanabilecek?
Her iki model de geliştiriciler için Gemini API ve Google AI Studio üzerinden kullanıma sunuldu.
Kurumsal tarafta Gemini 3.8 Live, Gemini Enterprise’da özel önizleme aşamasında bulunuyor ve Gemini Enterprise for Customer Experience desteğinin de yakında sunulması planlanıyor. Extended Thinking ise Gemini Enterprise’da özel önizlemede; Gemini Enterprise for Customer Experience ve Google Workspace kurumsal müşterilerine yönelik desteğin de daha sonra gelmesi bekleniyor.
Son kullanıcı tarafında Gemini 3.8 Live, Search Live üzerinden sunuluyor. Extended Thinking ise Gemini Live üzerinden kullanıma açılıyor. Google Workspace tarafında Docs için Google AI Pro ve Ultra aboneleri, Gmail ve Keep için ise tüm Google AI aboneleri kapsama giriyor.
Dağıtım kademeli olarak gerçekleştirildiği için özelliklerin her kullanıcı veya hesapta aynı anda görünmeyebileceğini de belirtmek gerekiyor.




