İçeriğe geç
Türkçe
FikirPilot içeriği

Gemini 3.8 Live ve 3.8 Live Extended Thinking tanıtılıyor

Güncellendi: 15.09.2026 · 2 dk okuma · 387 kelime

Yayımlandı: · Haber bize ulaştı: · İşlenme süresi: 2 sa 47 dk

Gemini 3.8 Live ve 3.8 Live Extended Thinking tanıtılıyor
Masada duran dijital ekranlı telefon

Google, sesli etkileşimleri daha doğal, akıcı ve akıllı hale getirmeyi amaçlayan Gemini 3.8 Live ile Gemini 3.8 Live Extended Thinking modellerini tanıttı. Modeller; karmaşık akıl yürütme, gerçek zamanlı görsel bağlam ve konuşmayı kesmeden arka planda görev yürütme özellikleri sunuyor. Kullanıcılar modellere bugün Gemini API, Google Workspace ve Gemini uygulaması üzerinden erişebiliyor.

Gemini 3.8 Live Extended Thinking, Artificial Analysis’ Speech to Speech Quality Index’te 82.6 puanla genel sıralamada birinci oldu. Model, görev tamamlama alanında τ-Voice’ta 68.6%, Sierra’s τ-Voice-banking testinde 35.1%, Big Bench Audio’da ise 97.7% aldı. Gemini 3.8 Live, Speech Agent Arena’da ikinci sıraya yerleşti. Modeller, ServiceNow’s EVA-Bench değerlendirmesinde doğruluk ile konuşma kalitesini dengeleyerek karmaşık iş akışlarında Pareto Frontier’ı geliştirdi.

Gemini 3.8 Live, görsel girdileri gerçek zamana yakın işleyerek konuşmalara bağlam ekliyor ve görüşme sırasında desteklenen 97 dil arasında otomatik geçiş yapabiliyor. Araçları ve API çağrılarını arka planda çalıştırırken sohbeti sürdürebiliyor. Görsel bağlamla çalışanlara uyum süreçlerinde rehberlik edebiliyor ve satranç oynayabiliyor.

Gemini 3.8 Live Extended Thinking ise aynı anda düşünüp konuşarak çok aşamalı görevlerde ilerlemeyi sesli biçimde aktarıyor. Ham çizimleri ve sesli geri bildirimleri işlevsel React bileşenlerine dönüştürebiliyor; rezervasyonları, eşzamansız işlev çağrılarını, iş planlarını ve pazarlama araçlarını konuşma yoluyla hazırlayabiliyor.

Model; Docs Live, Gmail Live ve Keep Live’da kullanılabiliyor. Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel ve Vision Agents, Gemini Live API ile sesli arayüz geliştirilmesini destekliyor. Google ayrıca Salesforce, Genspark ve Lumeris ile çalışıyor. Üretilen tüm sesler, yanlış bilgilendirmeye karşı tespit edilebilmeleri için SynthID ile işaretleniyor.

Neden önemli

Bu duyuru, sesli yapay zekâ kullanımını yalnızca soru-cevap düzeyinden çıkarıp görsel bağlam, araç kullanımı ve çok aşamalı iş akışlarını aynı etkileşim içinde birleştiren bir çerçeve sunuyor. Bu nedenle özellikle Google Workspace kullananlar, geliştiriciler ve konuşma tabanlı arayüz oluşturan şirketler açısından yeni uygulama olanakları yaratıyor. Modellerin farklı testlerdeki sonuçları, Google’ın ses kalitesi ile görev tamamlama arasındaki dengeyi birlikte ölçtüğünü gösteriyor; ancak bu kıyaslamaların günlük kullanımda rezervasyon, iş planı veya uyum rehberliği gibi görevlerde ne ölçüde karşılık bulacağı açık kalıyor. Seslerin SynthID ile işaretlenmesi üretilen içeriğin ayırt edilmesine yardımcı olmayı hedeflerken, bunun kullanıcıların güven kararlarını nasıl etkileyeceği de izlenmesi gereken bir konu olarak duruyor.

Arka plan

Gemini, FikirPilot arşivinde yeni bir ad değil: son 90 günde bu adın geçtiği 10 haber yayımladık; en yenisi 8 Eylül 2026 tarihli.

Kaynak: Google DeepMind