Canaltech · Brasil
Novo Gemini raciocina enquanto conversa por voz com usuário
O Google anunciou os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, capazes de raciocinar enquanto conversam por voz com o usuário e executar tarefas em segundo plano sem interromper o diálogo. O primeiro prioriza interações rápidas, escala e custo-benefício; o segundo foi desenvolvido para solicitações que exigem várias etapas de processamento. Ambos oferecem suporte visual em tempo real, detecção automática de idiomas e alternância entre 97 idiomas na mesma conversa.
Os modelos podem consultar informações, criar códigos e realizar reservas enquanto mantêm a conversa, além de combinar voz e imagem para interpretar ambientes em tempo real. O Gemini 3.8 Live já está disponível no Search Live, enquanto os recursos do Extended Thinking chegam ao aplicativo Gemini e ao Google Workspace, com disponibilidade conforme o serviço e o plano contratado. As soluções também estão acessíveis a desenvolvedores pela Gemini API e pelo Google AI Studio e entram em prévia privada para empresas no Gemini Enterprise. Áudios gerados pelo Gemini Live recebem uma marca-d'água imperceptível por meio do SynthID.
Compartilhar esta notícia