A Google DeepMind revelou esta segunda-feira, dia 15 de setembro de 2026, o lançamento de dois novos modelos de inteligência artificial: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. Estes sistemas representam a aposta mais recente da tecnológica em melhorar a qualidade das interações por voz, procurando tornar a comunicação entre humanos e máquinas num processo mais natural, fluido e inteligente. Segundo a empresa, o objetivo central é permitir que os utilizadores colaborem com a inteligência artificial de forma mais eficaz, utilizando apenas a voz para executar tarefas que exigem um elevado nível de processamento e raciocínio.
O Gemini 3.8 Live foi desenhado com um foco particular na escalabilidade e na eficiência de custos, combinando capacidades de diálogo fluido com uma forte base visual. Esta variante pretende ser a solução ideal para interações rápidas e conversacionais, mantendo a capacidade de compreender o contexto visual em tempo real. Por outro lado, o Gemini 3.8 Live Extended Thinking surge como uma proposta mais robusta, vocacionada para a resolução de problemas de elevada complexidade. Este modelo integra capacidades acrescidas de raciocínio multi-etapa, permitindo que a inteligência artificial processe tarefas exigentes enquanto mantém o fluxo da conversa.
Uma das inovações técnicas destacadas pelos engenheiros da Google é a capacidade destes modelos operarem em segundo plano. Enquanto o utilizador mantém uma conversa ativa, o sistema é capaz de gerir ferramentas e executar tarefas complexas sem interromper o diálogo. Esta funcionalidade visa eliminar as pausas artificiais que frequentemente ocorrem em assistentes de voz tradicionais, permitindo que a inteligência artificial acompanhe o utilizador de forma contínua. A empresa sublinha que esta evolução é um passo significativo para transformar a inteligência artificial num parceiro de conversação mais capaz e atento.
Para os programadores e empresas, a Google disponibiliza estes modelos como blocos de construção para a criação de agentes de voz prontos para ambientes de produção. A integração destas tecnologias estende-se também ao ecossistema da Google, estando já disponíveis através da API do Gemini, no Google Workspace e na aplicação Gemini. A promessa é que a experiência de utilização nestas plataformas seja mais colaborativa, permitindo que os utilizadores resolvam problemas intrincados apenas através de comandos de voz, sem a necessidade de recorrer a interfaces gráficas complexas.
Apesar das promessas de uma maior fluidez e inteligência, a Google recorda que a utilização de inteligência artificial generativa continua a ser uma área experimental. A empresa incentiva os utilizadores a testarem estas novas capacidades nas ferramentas de pesquisa e produtividade, mantendo uma postura de cautela quanto aos resultados obtidos. Com este lançamento, a Google procura consolidar a sua posição no mercado de modelos de voz, competindo diretamente com outras soluções que tentam aproximar a interação por voz da naturalidade de uma conversa humana real.
Porque importa
Este lançamento marca uma evolução na forma como os utilizadores interagem com a IA, movendo o foco de comandos simples para uma colaboração contínua e complexa por voz, o que poderá alterar significativamente a produtividade em ambientes profissionais e pessoais.