O Google Cloud introduziu o "Gemini agent", uma nova solução de inteligência artificial destinada ao ambiente corporativo. A empresa descreve este sistema como um agente universal e singular para o trabalho, projetado para realizar tarefas de conhecimento, gerar conteúdo multimídia e desenvolver ou executar código.
Esta inovação será integrada ao Gemini Enterprise, ao Google Workspace e a serviços de terceiros. A intenção é transformar a maneira como os usuários interagem com a IA: basta que o usuário defina o objetivo, e o sistema se encarrega de determinar todas as etapas necessárias para concretizar a tarefa.
No cotidiano profissional, o Gemini agent tem a capacidade de identificar atividades passíveis de delegação. Por exemplo, se um gestor envia um e-mail solicitando a versão mais atualizada de um projeto em uma apresentação de slides, o Workspace Intelligence reconhece essa demanda e oferece a opção de encaminhá-la ao Gemini com apenas um clique.
Além disso, a ferramenta pode organizar reuniões sem exigir que o usuário forneça nomes ou endereços de e-mail. Utilizando o histórico de um evento anterior e o espaço de conversação, o sistema identifica os participantes necessários, verifica os calendários e inicia uma comunicação para encontrar um horário conveniente, mesmo incluindo pessoas externas.
A funcionalidade do Gemini agent transcende tarefas isoladas; ele pode operar em nome de um grupo, atuando como um gerente de projetos, ou assumir papéis específicos dentro de uma organização, como analista financeiro.
Para cumprir cada incumbência, o sistema seleciona o modelo de IA que julgar mais apropriado. Os modelos de IA são sistemas treinados para processar dados e produzir resultados, sejam eles respostas, textos ou códigos. Atualmente, o Gemini agent emprega as famílias Gemini e Claude, embora o Google planeje oferecer suporte futuro a outros modelos de código aberto e privados.
Quando uma atividade requer múltiplas fases, o Gemini agent pode utilizar subagentes, que são sistemas de IA trabalhando em colaboração com o agente principal, para segmentar o trabalho. Estes subagentes podem operar de forma sequencial ou paralela, abrangendo processos que se estendem por horas ou até dias.
A arquitetura também mantém um repositório centralizado na nuvem contendo memória, contexto e personalização. O Google categoriza este sistema em quatro grupos distintos.
Dentro do Gmail, Google Docs, Sheets, Slides e Chat, o Gemini agent poderá ser invocado mencionando @Gemini. Este recurso também está disponível em diversos dispositivos e canais, incluindo linha de comando, Slack e Microsoft 365.
Mais informações sobre a integração
Uma API, que funciona como um meio para conectar diferentes softwares, viabiliza a integração dessa tecnologia em aplicações de terceiros. Neste formato, denominado pelo Google como "headless agent", o Gemini pode funcionar nos bastidores, sem necessitar de uma interface própria.
Atualmente em fase de prévia privada, com acesso restrito, o Gemini agent terá uma ampla disponibilidade em breve para clientes do Google Workspace que possuam planos Business e Enterprise específicos.
