Google, Gemini 3.8 Live ve Extended Thinking modellerini tanıttı

Google, gerçek zamanlı sesli iletişim deneyimini geliştirmek için Gemini 3.8 Live ve Gemini 3.8 Live Extended Thinking modellerini duyurdu.

Yeni modeller, doğal sesli diyalogların yanı sıra görsel algılama ve karmaşık görevlerde arka planda akıl yürütme yetenekleri sunuyor.

Gemini 3.8 Live neler sunuyor?

Gemini 3.8 Live, özellikle hızlı ve düşük gecikmeli sesli etkileşimler için geliştirildi. Model; metin, ses, görüntü ve video girdilerini işleyebiliyor ve gerçek zamanlı konuşmalar sırasında görsel bağlamı da değerlendirebiliyor. Google, modeli özellikle sesli asistanlar ve geliştiricilerin oluşturduğu gerçek zamanlı uygulamalar için konumlandırıyor.

Model aynı zamanda araç çağrılarını arka planda gerçekleştirebiliyor. Böylece bir işlem devam ederken konuşmanın tamamen durması gerekmiyor. Bu özellik, müşteri hizmetleri, sesli arama ve akıllı cihaz kontrolü gibi alanlarda kullanılabilecek uygulamaların önünü açıyor.

Extended Thinking ile karmaşık görevler

Gemini 3.8 Live Extended Thinking ise daha karmaşık ve çok aşamalı görevler için tasarlandı. Model, kullanıcıyla konuşmayı sürdürürken arka planda planlama yapabiliyor ve gerekli araçları eş zamanlı olarak kullanabiliyor. Bu sayede uzun süren işlemlerde kullanıcı sessizlikle karşılaşmak yerine yapay zekanın ilerleme durumuna ilişkin sesli geri bildirim alabiliyor.

Google, iki modeli Gemini uygulaması, Gemini API, Google AI Studio, Workspace ve Search gibi farklı ürün ve platformlarda kullanıma sunuyor. Extended Thinking sürümü ise özellikle karmaşık sesli görevlerde kullanılmak üzere Gemini uygulamasında da devreye giriyor.

Yeni modellerle birlikte Google, sesli yapay zekanın yalnızca sorulara cevap veren bir sistem olmaktan çıkıp konuşma sırasında görevleri arka planda gerçekleştirebilen daha gelişmiş bir asistana dönüşmesini hedefliyor.

Paylaş
Teknoloji Turu'nu Google'da kaynak olarak ekle