La génération d’images par intelligence artificielle et par texte a bouleversé le Web. Ces dernières semaines, nous avons vu de tout, des moteurs de recherche dédiés jusqu’aux premiers prix dans des concours d’art. Mais il faut aussi explorer la zone grise derrière ces générateurs : des millions d’illustrations, de peintures et de photographies collectées sans la permission ou l’autorisation correspondante. Le portail Have I Been Trained veut aider utilisateurs et artistes à retrouver leurs travaux et photos dans les modèles d’entraînement, et si possible, demander leur retrait.
« Des nains sur les épaules de géants » (en latin : « Nanos gigantum humeris insidentes »). Dans sa version la plus moderne, se tenir sur les épaules de géants. La phrase évoque la découverte de vérités inspirées de travaux et de découvertes antérieurs, mais on peut l’appliquer à bien d’autres choses, notamment aux intelligences artificielles. Un algorithme ne vaut que par son entraînement, et si l’on s’intéresse à des projets comme DALL-E 2, Stable Diffusion et Midjourney, cet entraînement s’appuie sur des milliards d’images… faites par quelqu’un d’autre.
Have I Been Trained ? Localisez votre art dans les modèles d’entraînement pour IA
Bien sûr, les images ne suffisent pas : les métadonnées sont fondamentales pour que le mécanisme de prompts ne donne pas de résultats absurdes, mais le débat éthique est immense, surtout avec Midjourney et Stable Diffusion qui vendent des « crédits » pour l’utilisation de leurs versions en ligne. La proposition de Mat Dryhurst, Holly Herndon, Jordan Meyer et P_Hoep est de donner aux artistes une option avec l’outil Have I Been Trained ?.
En résumé, l’idée est que les artistes puissent saisir des paramètres spécifiques ou effectuer une recherche inversée en téléchargeant des images pour détecter si leur travail fait partie de l’ensemble LAION-5B. Dans le même temps, les utilisateurs peuvent effectuer la même recherche sur leurs propres photos ou travaux partagés sur différentes plateformes.
Si le résultat est positif, l’étape suivante consiste à rejoindre le projet Spawning, actuellement en version bêta, pour développer un standard qui permette aux artistes de définir un opt-in / opt-out dans les modèles d’entraînement, de spécifier des autorisations ou des limites lorsqu’il s’agit d’adopter leur style, et de proposer leurs propres modèles au public.
Dans quelle mesure cela fonctionnera-t-il ? Honnêtement, nous ne le savons pas, mais une chose est sûre : la collecte de matériel public continuera. Le concept de scraping est légal aux États-Unis (pour l’instant), et les lois sur le droit d’auteur dans le monde entier ont des articles entiers consacrés aux « œuvres dérivées ». Tout outil qui aide à résoudre les conflits est le bienvenu, et nous espérons que Have I Been Trained ? et Spawning continueront à progresser.
(Note de la rédaction : Le site utilise des filtres NSFW, mais ne parvient pas à tout bloquer. Soyez prudents.)
Site officiel : Cliquez ici