Les développements autour de la génération d'images par intelligence artificielle continuent de progresser. Nous avons des applications mobiles, des effets de profondeur, de la vidéo et de l'animation, mais ne négligeons pas les interfaces pour l'exécution locale de modèles. Dans le cas spécifique de Stable Diffusion, la solution d'Automatic1111 est la plus compatible et flexible, mais si vous préférez un environnement intuitif et facile à utiliser, avec d'excellentes fonctions pour étendre les images au-delà de leur taille d'origine, vous devez examiner de près InvokeAI.
Il existe au moins trois voies pour générer des images par intelligence artificielle. D'une part, nous avons DALL-E, avec Craiyon comme l'une de ses meilleures options gratuites en ligne. Ensuite, Midjourney, extrêmement populaire sur les réseaux sociaux, mais qui nécessite Discord et l'achat de jetons. Enfin, nous arrivons à Stable Diffusion, qui en plus de proposer un mode en ligne gratuit, permet également son exécution hors ligne, avec une carte graphique.
Au début, tout fonctionnait dans la console système, mais le projet d'Automatic1111 a donné naissance à une interface web pour Stable Diffusion avec un haut niveau de compatibilité et de flexibilité. Cependant, nous devons également reconnaître que l'état d'Automatic1111 est un peu chaotique, avec plus de 1 300 problèmes ouverts sur GitHub et une documentation pas tout à fait optimale. Maintenant, si vous avez assez de puissance pour exécuter Stable Diffusion hors ligne et que vous cherchez une alternative à l'interface d'Automatic1111, toutes les flèches pointent vers InvokeAI.
InvokeAI : une des meilleures interfaces web pour Stable Diffusion
L'un des aspects les plus positifs d'InvokeAI est son installation. Les exigences principales sont au nombre de trois : l'installation de Python (3.10.6 est un bon choix car il maintient la compatibilité avec Automatic1111), l'application d'un correctif dans le Registre qui active des chemins de lecteur plus longs, et environ 25 Go d'espace disque. Un double clic sur install.bat lancera le processus lui-même, mais il n'est pas automatique à 100 %. InvokeAI demandera la destination des fichiers et les modèles à installer (la liste recommandée est un bon point de départ). Évidemment, cela signifie qu'InvokeAI téléchargera des fichiers très volumineux, donc de la patience.
De loin, la fonction la plus puissante d'InvokeAI est le Unified Canvas, qui combine des fonctions d'inpainting, d'outpainting, de texte vers image et d'image vers image. Tant l'inpainting (modifier ou régénérer des parties spécifiques d'une image) que l'outpainting (étendre une image avec des détails supplémentaires) laissent beaucoup à désirer dans l'interface d'Automatic1111, mais il est clair qu'InvokeAI a fait mouche avec sa dernière édition.
Malgré ces fonctions impressionnantes, InvokeAI possède des limitations qu'il faut souligner. La première est le nombre de jetons (en d'autres termes, si notre prompt est trop long, InvokeAI ignore l'excédent), mais la plus importante est son manque d'efficacité dans l'utilisation de la VRAM, à tel point que je recommande d'ignorer complètement InvokeAI si la carte graphique dispose de 6 Go de VRAM ou moins. Dans ce cas, la meilleure option est de revenir à Automatic1111 et d'activer les commandes --medvram ou --lowvram, qui fonctionnent très bien (malgré la baisse de performances).
Site officiel : Cliquez ici