Dans les dernières heures, les gens de Stability.ai ont annoncé le lancement du nouveau modèle «Stable Diffusion 3 Medium », qui (soi-disant) comprend deux milliards de paramètres, une compréhension plus précise des prompts, et des améliorations générales sur des aspects comme le photoréalisme. Ce modèle privilégie également son fonctionnement dans des environnements avec une quantité de VRAM plus limitée, mais si vous voulez voir ce qu'il peut faire avant de lancer un téléchargement, le fait est que des espaces gratuits existent déjà sur HuggingFace

Comment générer des images avec le nouveau Stable Diffusion 3 Medium en ligne
Comment générer des images avec le nouveau Stable Diffusion 3 Medium en ligne

J'avoue que je suis déconnecté de la génération d'images avec intelligence artificielle. Après avoir obtenu des centaines de milliers de résultats avec Auto1111 et les modèles disponibles sur Civitai, on commence inévitablement à reconnaître des schémas, erreurs, limitations. S'ajoutent à cela les exigences matérielles : des modèles plus complexes demandent une plus grande quantité de VRAM, et la seule alternative pour de nombreux utilisateurs a été de recycler d'anciens modèles.

C'est ainsi que nous arrivons à Stable Diffusion 3 Medium, qui, en théorie, a reçu plusieurs optimisations pour garantir son exécution sur du matériel commercial. Dans mon esprit, cela signifie «n’importe quel GPU avec 8 Go de VRAM ou moins», mais au lieu de partager des liens vers des guides d'installation et de téléchargement, je recommande aujourd'hui quelque chose de beaucoup plus simple : visiter HuggingFace, et tester les démos gratuites de Stable Diffusion 3 Medium en ligne.

Tester Stable Diffusion 3 Medium en ligne et gratuitement

Comment générer des images avec le nouveau Stable Diffusion 3 Medium en ligne
Comme prévu, les modèles sont sous le feu des critiques...

Pourquoi ? Eh bien… parce qu'ils se le font démolir sur Reddit. On suppose que le modèle est plus fort pour générer des images photoréalistes, et c'est vrai si nous reproduisons des paysages ou des structures, mais le problème se pose quand des humains entrent dans l'équation. Les «vieux trucs» semblent bien fonctionner (mains dans les poches ou derrière le dos, prompts négatifs étendus, etc.), cependant, il est très difficile d'accepter que ces modèles continuent de commettre les mêmes erreurs après si longtemps, alors que leurs concurrents génèrent déjà (au minimum) des mains correctement depuis un an.

Comment générer des images avec le nouveau Stable Diffusion 3 Medium en ligne
«image très détaillée d'un bunker militaire abandonné au milieu du désert. Lumière du jour dans le désert profond, chaleur, ciel bleu éclatant. Métal rouillé et béton qui s'effrite, murs brisés, poutres exposées, environnement post-apocalyptique.»
Comment générer des images avec le nouveau Stable Diffusion 3 Medium en ligne
«photographie professionnelle d'une femme caucasienne attendant à un arrêt de bus. Portant un long manteau bleu foncé, les mains dans les poches, un petit bonnet de laine blanc, une écharpe verte. Cheveux noirs courts en pixie, yeux verts, regardant la caméra. Journée d'hiver pluvieuse, humidité, froid.»

Les utilisateurs blâment l'«excès de censure» de la part de Stability.ai (quelque chose qui s'est déjà produit avec les versions précédentes), mais d'autres associent la qualité du modèle aux difficultés financières que traverse actuellement l'entreprise. Politique interne mise à part, si vous souhaitez tester vos propres prompts dans Stable Diffusion 3 Medium, cliquez sur le lien ci-dessous, choisissez l'un des «Spaces» disponibles… et soyez patient. Par moments, il est très difficile d'accéder à un GPU libre…

Testez Stable Diffusion 3 Medium : Cliquez ici