Santos, Quarta-feira, 30 de setembro de 2026
Dólar R$ 5,22 · Euro R$ 5,92 · Ibovespa 183.828 -0,00% Santos 23°C 22° / 27°
Notícia a toda hora
Tecnologia

Google apresenta modelos Gemini para conversar e executar tarefas por voz

Gemini 3.8 Live e versão Extended Thinking chegam a APIs, produtos do Workspace e recursos de busca por voz.

Google apresenta modelos Gemini para conversar e executar tarefas por voz
Foto: One Artist/Shutterstock

O Google anunciou nesta terça-feira (15) dois modelos de inteligência artificial voltados a interações por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. As ferramentas foram desenvolvidas para manter conversas mais naturais enquanto executam tarefas em segundo plano.

O Gemini 3.8 Live é direcionado a interações de voz em maior escala e com foco em eficiência. O modelo consegue realizar chamadas de API e acionar ferramentas sem interromper o diálogo. Assim, a inteligência artificial pode receber uma solicitação, continuar conversando e trabalhar na tarefa ao mesmo tempo.

A ferramenta também processa informações visuais fornecidas por câmeras e outras fontes praticamente em tempo real. Durante a conversa, identifica e alterna automaticamente entre 97 idiomas. Segundo o Google, o modelo ficou em segundo lugar nas avaliações de usuários do Speech Agent Arena e é oferecido a desenvolvedores e empresas.

O Gemini 3.8 Live Extended Thinking acrescenta raciocínio avançado e processamento em várias etapas. A tecnologia consegue raciocinar e falar simultaneamente, mantendo a interação enquanto executa tarefas mais longas. Também pode explicar o andamento do trabalho e responder durante o processamento, em vez de permanecer em silêncio.

As capacidades chegam ao Google Workspace por meio de recursos de voz para Docs, Gmail e Keep. No Docs Live, comandos de voz podem ser usados para realizar tarefas em documentos. O mesmo princípio se aplica ao Gmail Live e ao Keep Live. O modelo também é incorporado ao Search Live, com orientação em tempo real e instruções passo a passo.

Em avaliações divulgadas pelo Google, o Gemini 3.8 Live Extended Thinking alcançou 82,6 pontos e ficou em primeiro lugar geral no Speech to Speech Quality Index, da Artificial Analysis. No teste τ-Voice, voltado à execução de tarefas por agentes, obteve 68,6%. No τ-Voice-banking, direcionado a tarefas financeiras, marcou 35,1%.

O Gemini 3.8 Live já está disponível para desenvolvedores pela Gemini API e pelo Google AI Studio. Empresas podem acessá-lo em prévia privada no Gemini Enterprise, enquanto usuários comuns terão acesso pelo Search Live. A versão Extended Thinking também chega à Gemini API e ao Google AI Studio e está em prévia privada no Gemini Enterprise.

Para usuários finais, a tecnologia é incorporada ao aplicativo Gemini e a recursos do Workspace. O Docs Live está disponível para assinantes dos planos Google AI Pro e Google AI Ultra. Já Gmail Live e Keep Live são oferecidos aos assinantes dos planos Google AI Plus, Google AI Pro e Google AI Ultra.

Texto produzido pela Redação Fato em Curso com apoio de inteligência artificial a partir de fontes públicas, com revisão editorial. Erros? Fale conosco.

Assine nossa newsletterAs principais notícias do dia no seu e-mail.