Google Lança IA que Controla Computadores e Aplicativos de Forma Autônoma
O Google anunciou a integração da função “Computer use” ao modelo Gemini 3.5 Flash, permitindo que agentes de inteligência artificial visualizem a tela e executem ações em computadores, navegadores e aplicativos de forma autônoma.
Essa novidade já está disponível para desenvolvedores e empresas por meio da API do Gemini e da plataforma Gemini Enterprise Agent. A ferramenta transforma o modelo em um agente que consegue realizar tarefas completas, como clicar em botões, preencher formulários, rolar páginas e navegar entre sistemas internos.
Funcionalidades e Aplicações
O foco inicial é o ambiente corporativo, com aplicações em automação de processos, análise de dados e testes de software. A empresa já havia incorporado recursos de navegação com agentes, como o Auto Browse no Chrome Enterprise, e agora amplia essa lógica para funcionar sobre qualquer tela.
Algumas das funcionalidades incluem:
- Execução de tarefas em várias etapas, como preenchimento de formulários e navegação em sistemas internos
- Testes de aplicativos e análise de dados
- Automação de processos
Segurança e Limitações
A empresa destaca que o sistema ainda enfrenta limitações em situações imprevisíveis, como CAPTCHAs, pop-ups e interfaces dinâmicas. Para reduzir riscos, foram incluídos mecanismos de segurança, como confirmação humana em ações sensíveis e interrupção automática em caso de detecção de possíveis tentativas de manipulação.
Além disso, o Google adotou treinamento adversário focado especificamente na prevenção de injeção de prompts, um tipo de ataque em que instruções maliciosas ocultas em páginas da web ou documentos podem induzir a IA a executar ações não intencionais.
Este conteúdo pode conter links de compra.
Fonte: link