Ir para o conteúdo
Português
Conteúdo FikirPilot

Gemini 3.8 Live e 3.8 Live Extended Thinking são apresentados

Atualizado: 15/09/2026 · 3 min de leitura · 506 palavras

Publicado: · Notícia recebida: · Tempo de processamento: 2 h 47 min

Fonte verificada:

Gemini 3.8 Live e 3.8 Live Extended Thinking são apresentados
Telefone com tela digital sobre uma mesa

A Google apresentou os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, que visam tornar as interações por voz mais naturais, fluidas e inteligentes. Os modelos oferecem recursos de raciocínio complexo, contexto visual em tempo real e execução de tarefas em segundo plano sem interromper a conversa. Os usuários já podem acessar os modelos por meio da Gemini API, do Google Workspace e do aplicativo Gemini.

O Gemini 3.8 Live Extended Thinking ficou em primeiro lugar na classificação geral do Speech to Speech Quality Index da Artificial Analysis, com 82,6 pontos. Na área de conclusão de tarefas, o modelo obteve 68,6% no τ-Voice, 35,1% no teste τ-Voice-banking da Sierra e 97,7% no Big Bench Audio. O Gemini 3.8 Live ficou em segundo lugar no Speech Agent Arena. Na avaliação EVA-Bench da ServiceNow, os modelos ampliaram a fronteira de Pareto em fluxos de trabalho complexos ao equilibrar precisão e qualidade da conversa.

O Gemini 3.8 Live processa entradas visuais quase em tempo real, acrescentando contexto às conversas, e consegue alternar automaticamente entre os 97 idiomas compatíveis durante a interação. Ele pode manter a conversa enquanto executa ferramentas e chamadas de API em segundo plano. Com contexto visual, pode orientar funcionários em processos de integração e jogar xadrez.

Já o Gemini 3.8 Live Extended Thinking pensa e fala simultaneamente, comunicando por voz seu progresso em tarefas com várias etapas. Ele consegue transformar esboços brutos e feedback por voz em componentes React funcionais, além de preparar reservas, chamadas assíncronas de funções, planos de negócios e ferramentas de marketing por meio de conversas.

O modelo está disponível no Docs Live, Gmail Live e Keep Live. Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents oferecem suporte ao desenvolvimento de interfaces de voz com a Gemini Live API. O Google também trabalha com Salesforce, Genspark e Lumeris. Todas as vozes geradas são marcadas com SynthID para que possam ser detectadas no combate à desinformação.

Por que isso é importante

Este anúncio oferece uma estrutura que leva o uso da inteligência artificial por voz além do nível de perguntas e respostas, combinando contexto visual, uso de ferramentas e fluxos de trabalho com várias etapas em uma única interação. Por isso, cria novas possibilidades de aplicação, especialmente para usuários do Google Workspace, desenvolvedores e empresas que criam interfaces baseadas em conversação. Os resultados dos modelos em diferentes testes mostram que o Google avalia conjuntamente o equilíbrio entre a qualidade da voz e a conclusão de tarefas; no entanto, ainda não está claro em que medida essas comparações se refletirão no uso cotidiano em tarefas como reservas, elaboração de planos de negócios ou orientação de integração. Embora a marcação das vozes com SynthID tenha como objetivo ajudar a distinguir o conteúdo gerado, a forma como isso afetará as decisões de confiança dos usuários também continua sendo uma questão a acompanhar.

Contexto

Gemini não é um nome novo no arquivo do FikirPilot: nos últimos 90 dias, publicamos 10 notícias que mencionam esse nome; a mais recente é de 8 de setembro de 2026.

Fonte de origem: Google DeepMind