In ons artikel over de beste AI-beeldgeneratoren geven we toe dat lokale omgevingen niet voor iedereen zijn… maar hun superioriteit valt niet te ontkennen. Het ontbreken van limieten en de mogelijkheid om meerdere modellen te gebruiken veranderen de regels volledig, maar zonder een goede interface hebben we daar niets aan. Zo komen we uit bij ComfyUI, dat zich laat inspireren door modulaire ontwerpen en stroomdiagrammen om een veel intuïtievere ervaring te bieden.

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
Offline afbeeldingen genereren met Stable Diffusion

Grenzen doorbreken

De gratis diensten die we recentelijk hebben gedeeld werken prima en zijn een uitstekend startpunt voor elke gebruiker die zonder iets te downloaden afbeeldingen wil genereren. Maar het uiteindelijke doel van al die diensten is dat het geld van eigenaar wisselt, en om dat te bereiken leggen ze alleen maar een reeks beperkingen op, waaronder het dagelijkse aantal tokens, de beschikbaarheid van modellen en natuurlijk het soort afbeeldingen dat we kunnen genereren.

Offlinemodellen op basis van Stable Diffusion pakken dat helemaal aan. Zodra we de grootste hindernis hebben overwonnen (een Nvidia-videokaart die niet achterblijft qua VRAM), gaat er een breed scala aan mogelijkheden open met alternatieve modellen, hoge resolutie, inpainting, upscaling, het combineren van modellen en nog veel meer. De eerste aanbeveling voor deze gevallen is Automatic1111 (met betere ondersteuning voor AMD- en Intel-GPU's), maar er is ook ComfyUI, en dat gaan we vandaag verkennen.

ComfyUI installeren om offline afbeeldingen te genereren met Stable Diffusion

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
De console is onze vriend. ComfyUI downloadt geen afhankelijkheden, maar heeft verhoogde rechten nodig.

Een van de meest positieve aspecten van ComfyUI is dat het kant-en-klaar is in een .7z-bestand van 1,4 gigabyte. Alle afhankelijkheden zijn inbegrepen, en het enige wat we moeten doen (naast het uitpakken van de inhoud) is het uitvoeren van het bestand run_nvidia_gpu.bat of run_cpu.bat (dit schakelt het gebruik van de CPU in, maar werkt erg langzaam) vanuit een systeemconsole met verhoogde rechten.

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
ComfyUI bevat geen modellen, maar Civitai heeft alles wat we nodig hebben en meer.

Maar voordat we zover zijn, moeten we een compatibel model downloaden. ComfyUI werkt met alle versies van Stable Diffusion, maar de beste suggestie is om Civitai te bezoeken, een model te zoeken dat ons aanspreekt en het te downloaden. De hoeveelheid NSFW-materiaal is daar erg groot, en het is geen goed idee om een openbare of werkcomputer te gebruiken. De modellen variëren van 1,5 tot 6,5 gigabyte en worden opgeslagen in de submap ComfyUI\models\checkpoints. Het maakt niet uit of het 'Checkpoints' of 'SafeTensors' (aanbevolen) zijn, beide werken op dezelfde manier.

ComfyUI voor de eerste keer gebruiken

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
Rustig maar...

Met de inhoud uitgepakt en ons model opgeslagen in de juiste submap is het tijd om run_nvidia_gpu.bat te openen. Als alles goed gaat, wordt er een tabblad geopend in de standaardbrowser met het adres http://127.0.0.1:8188/, waarmee de interface van ComfyUI wordt getoond.

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
De interface stelt ons in staat om de kleur van bepaalde modules te wijzigen. Hier gebruiken we groen voor de prompt en rood voor de negatieve prompt.

Geen zorgen. Het lijkt alsof het door een buitenaards wezen is ontworpen, maar het heeft veel logica. Deze standaardconfiguratie biedt alles wat we nodig hebben om bijna onmiddellijk afbeeldingen te genereren, en vereist slechts een handvol aanpassingen.

  • De module Load Checkpoint stelt ons in staat om de geïnstalleerde modellen te selecteren. Hier moeten we op de pijltjes klikken totdat de naam van het model verschijnt dat we van Civitai hebben gehaald. De drie punten met hun verbindingen, aangeduid als Model, CLIP en VAE, blijven intact.
  • In dit voorbeeld zijn er twee modules genaamd CLIP Text Encode, en ze zijn identiek op één essentieel detail na: de ene heeft een positieve conditie (oftewel “wat we willen zien” in de afbeelding), en de andere een negatieve conditie (“wat we niet willen zien”). Hier laden we de prompts, en de verbindingen van Conditioning gaan respectievelijk naar Positive en Negative.
ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
De KSampler-module helpt ons geavanceerde parameters voor de generatie in te stellen.
  • De module Empty Latent Image stelt alleen de uiteindelijke resolutie van de afbeeldingen in en hoe groot de batch moet zijn. Als we in beide velden zeer hoge waarden kiezen, neemt het risico toe dat de beschikbare VRAM verzadigd raakt. We moeten experimenteren.
  • Hetzelfde geldt voor de module KSampler. De magie gebeurt hier: KSampler biedt controle over de seed en hoe deze moet worden verwerkt (randomize is ideaal), het aantal stappen, guidance of intensiteit (CFG), sampler, scheduler en het niveau van denoise. Persoonlijk geef ik er de voorkeur aan om het aantal stappen te verhogen naar 30 en de CFG te verlagen naar 7. De combinatie euler/normal is geschikt om te beginnen, en de denoise zou op 1.00 moeten blijven bij nieuwe generaties.
ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
De laatste modules vereisen bijna geen tussenkomst van de gebruiker.
  • De laatste twee modules zijn VAE Decode, dat de latente chaos omzet in echte afbeeldingen (geen tussenkomst van de gebruiker nodig), en Save Image, dat automatisch alle resultaten opslaat in de map ComfyUI/output en ze in een mini-galerij toont. Een klik op Queue Prompt start de generatie.

Ad infinitum

ComfyUI gebruiken om offline afbeeldingen te genereren met Stable Diffusion
Met offline generatie verbruiken fouten geen tokens.

Zijn de afbeeldingen niet goed? Probeer het gewoon opnieuw, en opnieuw, en opnieuw… zo vaak als nodig. De vrijheid ten opzichte van tokens stelt ons in staat dit tot vervelens toe te doen, nieuwe modellen te testen, LoRA's, embeddings en tekstuele inversies toe te voegen… maar dat is een ander verhaal.

Het punt is dat met ComfyUI fouten geen kosten met zich meebrengen, er zijn geen tokens om te verbranden. We hebben nog maar net het oppervlak van deze interface verkend, en de community biedt al tientallen extra modules, maar in de standaardconfiguratie biedt ComfyUI een solide platform om offline afbeeldingen te genereren met kunstmatige intelligentie, en ik denk dat iedereen met de juiste hardware het eens zou moeten proberen.

Officiële site en download: Klik hier