Independentemente do algoritmo utilizado, a geração de imagens baseada em inteligência artificial sempre começa da mesma forma: com uma descrição do que você quer ver. No entanto, um detalhe muito interessante é que o processo também funciona na direção oposta, ou seja, podemos carregar uma imagem já existente e solicitar sua interpretação. Esse sistema é conhecido como CLIP Interrogator, e possui uma versão online muito fácil de usar.
Nas últimas semanas, compartilhamos alguns recursos que ajudarão você a criar suas primeiras imagens com inteligência artificial sem muitos percalços. Por exemplo, o portal Lexica oferece um excelente mecanismo de busca com exemplos visuais acompanhados de seus prompts e o número de seed, enquanto o Public Prompts possui uma série de descrições mais específicas. Uma boa engenharia de prompts é fundamental para obter resultados detalhados, mas se você se sente preso entre expressões estranhas e nomes desconhecidos, por que não inverter a equação?
Como gerar prompts a partir de imagens existentes usando o CLIP Interrogator
Refiro-me a carregar uma imagem e deixar o algoritmo tentar interpretá-la. O prompt não será perfeito, mas pelo menos servirá como base para que você possa desenvolver sua própria descrição. A ferramenta chama-se CLIP Interrogator, e a melhor parte é que você não precisa instalar nada para começar a usá-la, a menos que prefira uma solução alternativa.
A versão disponível no Hugging Face funciona muito bem, e o tempo de espera não é muito longo. Antes de carregar suas próprias imagens, recomendo usar uma das amostras para visualizar melhor os resultados. Um dos aspectos mais interessantes do CLIP Interrogator é que ele ajudará você a conhecer novos artistas com um estilo semelhante ao que tenta reproduzir, e não se limita à pintura: também encontrará referências a fotógrafos e escultores.
Para finalizar, o CLIP Interrogator atravessa uma fase viral, já que muitos usuários no Twitter estão usando para obter descrições de suas próprias selfies com resultados hilários, e além disso já está integrado ao WebUI, de forma que você pode executá-lo offline. No entanto, devo acrescentar que os modelos são ligeiramente diferentes, e isso se refletirá nos prompts.
Site oficial: Clique aqui