O Google está dando mais autonomia ao Gemini dentro de seus próprios serviços. O Gemini Spark, agente de inteligência artificial da empresa, ganhou integração com o Google Fotos e agora pode executar tarefas diretamente na biblioteca de imagens do usuário.
A novidade permite ir além de simplesmente perguntar à IA onde está determinada fotografia. O agente pode procurar e selecionar imagens, organizar álbuns, realizar edições, criar colagens, compartilhar conteúdos e até executar determinadas tarefas de forma recorrente.
Por enquanto, porém, a integração está sendo liberada gradualmente para usuários elegíveis dos planos Google AI Pro e Ultra nos Estados Unidos, em inglês. O Google não informou quando a novidade chegará ao Brasil.
O que o Gemini pode fazer no Google Fotos?
Com a integração, o usuário pode descrever uma tarefa para o Gemini Spark e deixar que o agente execute diferentes etapas.
É possível, por exemplo, pedir para encontrar fotografias de determinado evento e selecionar as melhores imagens. A busca também pode considerar informações como data, local ou assunto.
O Gemini Spark também consegue criar álbuns privados ou compartilhados, montar colagens, realizar ajustes em fotografias e organizar imagens encontradas na biblioteca.
Quando uma edição é realizada, a fotografia original não é substituída. O Google Fotos mantém o arquivo original e salva uma nova versão com as alterações realizadas.
Gemini também pode executar tarefas recorrentes
Uma das diferenças do Spark em relação a uma conversa convencional com um chatbot é a possibilidade de realizar fluxos de trabalho com várias etapas.
O usuário pode programar, por exemplo, a criação periódica de um álbum com os principais registros do mês.
Outro uso possível é organizar fotografias de recibos ou documentos armazenados na biblioteca. O sistema também consegue extrair textos encontrados em imagens e utilizar essas informações em outras tarefas.
Isso aproxima o Gemini de um modelo de inteligência artificial que não apenas fornece uma resposta, mas executa ações em nome do usuário.
Como usar o Gemini Spark com o Google Fotos?
Nos mercados onde a função estiver disponível, será necessário conectar o Google Fotos ao Gemini e ativar o Spark dentro do aplicativo.
Depois disso, o usuário poderá escrever o que deseja que seja realizado.
Em vez de abrir o Google Fotos, procurar dezenas de imagens e criar manualmente um álbum, por exemplo, será possível entregar toda a sequência de tarefas ao agente.
Algumas ações consideradas mais sensíveis continuam dependendo da autorização do usuário. Novos álbuns são privados por padrão e o Spark solicita permissão antes de compartilhá-los ou enviar determinadas informações por outros aplicativos.
Google amplia aposta nos agentes de IA
A integração ajuda a mostrar uma mudança importante na disputa pela inteligência artificial.
Os primeiros chatbots generativos ficaram conhecidos principalmente pela capacidade de responder perguntas, escrever textos e produzir imagens. A nova corrida das grandes empresas de tecnologia está nos chamados agentes de IA.
Nesse modelo, a inteligência artificial recebe um objetivo e pode executar diferentes ações para concluí-lo.
Ao integrar esse tipo de tecnologia a serviços como o Google Fotos, o Google tenta levar os agentes para tarefas comuns do cotidiano, aproveitando produtos que já concentram dados e arquivos pessoais dos usuários.
A mudança também transforma a relação entre IA e aplicativos. Em vez de o usuário precisar navegar por diferentes menus para realizar cada ação, a tendência é que determinadas tarefas possam ser delegadas diretamente ao assistente.
Quando o novo Gemini chega ao Brasil?
Ainda não há uma data anunciada para a chegada da integração entre Gemini Spark e Google Fotos ao mercado brasileiro.
A liberação inicial está prevista para usuários elegíveis maiores de 18 anos nos Estados Unidos, em inglês, vinculados aos planos Google AI Pro e Ultra.
A expansão internacional dependerá de novos anúncios do Google.


