Introdução do Gemini 3.1 Flash Live: O Modelo de Voz Mais Avançado do Google
O Google lançou o Gemini 3.1 Flash Live, um modelo de voz desenvolvido para proporcionar diálogos em tempo real mais naturais, rápidos e confiáveis. Essa tecnologia está disponível para usuários comuns, desenvolvedores e empresas, oferecendo uma experiência de interação mais avançada com a inteligência artificial (IA) por voz.
Funcionalidades do Gemini 3.1 Flash Live
O Gemini 3.1 Flash Live apresenta várias melhorias em relação às versões anteriores. Ele responde mais rapidamente e entende melhor detalhes da fala, como tom, ritmo e entonação. Além disso, consegue acompanhar conversas por duas vezes mais tempo que a versão anterior, ajustando suas respostas ao perceber expressões de frustração ou confusão dos usuários.
- Resposta mais rápida e compreensão de detalhes da fala
- Acompanhamento de conversas por mais tempo
- Ajuste de respostas baseado em expressões de frustração ou confusão
Disponibilidade e Funcionalidades Adicionais
O Gemini 3.1 Flash Live é multilíngue e funciona em mais de 200 países e territórios, permitindo conversas multimodais no Search Live, utilizando o idioma preferido do usuário. Além disso, todo áudio gerado recebe uma marca d’água digital SynthID, que identifica conteúdo produzido por IA e ajuda a combater a desinformação.
Desempenho em Testes
No benchmark ComplexFuncBench Audio, o Gemini 3.1 Flash Live atingiu 90,8%, demonstrando sua capacidade de executar tarefas em várias etapas. Já no teste Scale AI’s Audio MultiChallenge, o modelo atingiu 36,1% com o recurso “thinking” ativado, medindo a habilidade da IA de seguir instruções complexas e manter o raciocínio a longo prazo.
O Gemini 3.1 Flash Live está disponível para todos os usuários no Gemini Live e Search Live. Desenvolvedores podem usar a versão prévia via API do Gemini Live no Google AI Studio, e as empresas conseguem acessar o modelo por meio do Gemini Enterprise for Customer Experience.
Este conteúdo pode conter links de compra.
Fonte: link