A geração de imagens com inteligência artificial e texto virou a Web de cabeça para baixo. Nas últimas semanas, vimos de tudo, desde buscadores dedicados até primeiros prêmios em concursos de arte. No entanto, também é necessário explorar a zona cinzenta por trás dos geradores: milhões de ilustrações, pinturas e fotografias foram coletadas sem permissão ou autorização. O portal Have I Been Trained busca ajudar usuários e artistas a localizar seus trabalhos e fotografias dentro dos modelos de treinamento e, se possível, solicitar sua remoção.
«Nanos gigantum humeris insidentes» — em sua versão mais moderna, estar sobre os ombros de gigantes. A frase aponta para a descoberta de verdades inspiradas em trabalhos e descobertas anteriores, mas podemos aplicá-la a muitas outras coisas, incluindo as inteligências artificiais. Um algoritmo é tão bom quanto seu treinamento, e se nos concentrarmos em projetos como DALL-E 2, Stable Diffusion e Midjourney, esse treinamento se baseia em bilhões de imagens... feitas por outra pessoa.
É claro que com as imagens não basta: os metadados são fundamentais para que o mecanismo de prompts não produza resultados absurdos, mas o debate ético que temos pela frente é imenso, especialmente com Midjourney e Stable Diffusion vendendo "créditos" para o uso de suas versões online. A proposta de Mat Dryhurst, Holly Herndon, Jordan Meyer e P_Hoep é dar aos artistas uma opção com a ferramenta Have I Been Trained?.
Have I Been Trained? Localize sua arte em modelos de treinamento para IA
Basicamente, a ideia é que os artistas possam inserir parâmetros específicos ou fazer uma busca reversa carregando imagens para detectar se seu trabalho faz parte do conjunto LAION-5B. Ao mesmo tempo, os usuários podem realizar a mesma busca aplicada a fotos ou trabalhos pessoais que tenham sido compartilhados em diferentes plataformas.
Se o resultado for positivo, o próximo passo é se juntar ao projeto Spawning, atualmente em versão beta, para desenvolver um padrão que habilite os artistas a definir um opt-in/opt-out nos modelos de treinamento, especificar permissões ou limites ao adotar seu estilo e oferecer seus próprios modelos ao público.
Quão bem isso funcionará? Honestamente, não sabemos, mas uma coisa é certa: a coleta de material público continuará. O conceito de scraping é legal nos Estados Unidos (por enquanto), e as leis de copyright ao redor do mundo possuem artigos inteiros dedicados a "obras derivadas". Qualquer ferramenta que ajude a resolver conflitos é bem-vinda, e esperamos que tanto o Have I Been Trained? quanto o Spawning continuem avançando.
(N. do R.: O site usa filtros NSFW, mas não consegue bloquear tudo. Tenha cuidado.)
Site oficial: Clique aqui