In unserem Artikel über die besten KI-Bildgeneratoren haben wir zugegeben, dass lokale Umgebungen nicht für jeden geeignet sind – aber ihre Überlegenheit ist unbestreitbar. Das Fehlen von Limits und die Möglichkeit, mehrere Modelle zu nutzen, ändern die Spielregeln komplett, doch ohne eine gute Benutzeroberfläche nützt das alles nichts. So kommen wir zu ComfyUI, das sich von modularen Designs und Flussdiagrammen inspirieren lässt, um ein viel intuitiveres Erlebnis zu bieten.

Die kostenlosen Dienste, die wir kürzlich geteilt haben, funktionieren gut und sind ein ausgezeichneter Ausgangspunkt für jeden, der Bilder generieren möchte, ohne etwas herunterzuladen. Aber ihr eigentliches Ziel ist es, dass das Geld den Besitzer wechselt, und dafür erlegen sie nur eine Reihe von Beschränkungen auf, darunter die tägliche Anzahl von Tokens, die Verfügbarkeit von Modellen und natürlich die Art von Bildern, die wir erzeugen können.

Die Offline-Modelle, die auf Stable Diffusion basieren, reißen das alles von Grund auf weg. Sobald wir die Hauptschwierigkeit überwunden haben – eine Nvidia-Grafikkarte, die bei der VRAM nicht zurückbleibt – eröffnet sich eine breite Palette an Möglichkeiten mit alternativen Modellen, hoher Auflösung, Inpainting, Upscaling, Kreuzung von Modellen und vielem mehr. Die Empfehlung Nummer eins für diese Fälle ist Automatic1111 (das besseren Support für AMD- und Intel-GPUs bietet), aber es gibt auch ComfyUI, und genau das werden wir heute erkunden.

ComfyUI: Bilder mit Stable Diffusion offline generieren
Bilder mit Stable Diffusion offline generieren

ComfyUI installieren für die Offline-Bildgenerierung mit Stable Diffusion

Einer der positiven Aspekte von ComfyUI ist, dass es bereits einsatzbereit in einer 1,4-Gigabyte-Datei im .7z-Format kommt. Alle Abhängigkeiten sind enthalten, und alles, was wir tun müssen (neben dem Entpacken des Inhalts) ist die Datei run_nvidia_gpu.bat oder run_cpu.bat (das aktiviert die CPU-Nutzung, funktioniert aber sehr langsam) in einer Systemkonsole mit erhöhten Rechten.

ComfyUI: Bilder mit Stable Diffusion offline generieren
Die Konsole ist unser Freund. ComfyUI lädt keine Abhängigkeiten herunter, benötigt aber erhöhte Rechte.

Aber bevor wir so weit kommen, müssen wir ein kompatibles Modell herunterladen. ComfyUI funktioniert mit allen Versionen von Stable Diffusion, aber der beste Vorschlag ist, Civitai zu besuchen, ein Modell auszuwählen, das uns anspricht, und es herunterzuladen. Die Menge an NSFW-Material ist dort sehr groß, und es ist keine gute Idee, einen öffentlichen oder Arbeitscomputer zu verwenden. Die Modelle liegen zwischen 1,5 und 6,5 Gigabyte und werden im Unterordner ComfyUI\models\checkpoints gespeichert. Egal ob „Checkpoints“ oder „SafeTensors“ (empfohlen), beide funktionieren auf die gleiche Weise.

ComfyUI: Bilder mit Stable Diffusion offline generieren
ComfyUI enthält keine Modelle, aber Civitai hat alles, was wir brauchen und mehr.

Die ersten Schritte mit ComfyUI

ComfyUI: Bilder mit Stable Diffusion offline generieren
Keine Sorge...

Mit entpacktem Inhalt und unserem Modell im richtigen Unterordner ist es Zeit, run_nvidia_gpu.bat zu öffnen. Wenn alles gut geht, wird ein Tab im Standardbrowser mit der Adresse http://127.0.0.1:8188/ geöffnet, der die ComfyUI-Oberfläche präsentiert.

ComfyUI: Bilder mit Stable Diffusion offline generieren
Die Oberfläche erlaubt es, die Farbe bestimmter Module zu ändern. Hier verwenden wir Grün für den Prompt und Rot für den negativen Prompt.

Keine Sorge. Es sieht aus, als wäre es von einem Außerirdischen entworfen, hat aber viel Logik. Diese Standardkonfiguration aktiviert alles, was wir brauchen, um fast sofort Bilder zu generieren, und erfordert nur eine Handvoll Anpassungen.

  • Das Modul Load Checkpoint erlaubt es, die installierten Modelle auszuwählen. Hier müssen wir auf die Pfeile klicken, bis der Name des Modells erscheint, das wir von Civitai haben. Die drei Punkte mit ihren Verknüpfungen, identifiziert als Model, CLIP und VAE, bleiben unverändert.
  • In diesem Beispiel gibt es zwei Module namens CLIP Text Encode, die bis auf ein wesentliches Detail identisch sind: Eines hat eine positive Bedingung (also, was wir in dem Bild sehen wollen), das andere eine negative Bedingung (also „was wir nicht sehen wollen“). Hier laden wir die Prompts, und die Conditioning-Verknüpfungen gehen zu Positive und Negative.
ComfyUI: Bilder mit Stable Diffusion offline generieren
Das KSampler-Modul hilft uns, erweiterte Parameter für die Generierung zu definieren.
  • Das Modul Empty Latent Image legt lediglich die endgültige Auflösung der Bilder fest und wie groß die Stapelverarbeitung sein soll. Wenn wir in beiden Feldern sehr hohe Werte wählen, erhöht sich das Risiko, die verfügbare VRAM zu überlasten. Man muss experimentieren.
  • Das Gleiche gilt für das Modul KSampler. Hier passiert die Magie: KSampler ermöglicht die Kontrolle über den Seed und wie er verarbeitet werden soll (randomize ist ideal), die Anzahl der Schritte, Guidance oder Intensität (CFG), Sampler, Scheduler und den Grad des Denoise. Persönlich bevorzuge ich es, die Schritte auf 30 zu erhöhen und den CFG auf 7 zu senken. Die Kombination euler/normal ist für den Anfang geeignet, und der Denoise sollte bei neuen Generierungen auf 1,00 bleiben.
ComfyUI: Bilder mit Stable Diffusion offline generieren
Die letzten Module erfordern fast keine Benutzereingriffe.
  • Die letzten beiden Module sind VAE Decode, das das latente Chaos in echte Bilder verwandelt (es erfordert keine Benutzereingriffe), und Save Image, das alle Ergebnisse automatisch im Ordner ComfyUI/output speichert und sie in einer Mini-Galerie präsentiert. Ein Klick auf Queue Prompt startet die Generierung.

Unbegrenzte Möglichkeiten

ComfyUI: Bilder mit Stable Diffusion offline generieren
Mit Offline-Generierung verbrauchen Fehler keine Tokens.

Sind die Bilder nicht gut? Einfach nochmal versuchen, und nochmal, und nochmal … so oft wie nötig. Die Freiheit gegenüber den Tokens erlaubt uns, das bis zur Langeweile zu tun, neue Modelle zu testen, LoRAs, Embeddings und Textinversionen einzubauen … aber das ist eine andere Geschichte.

Der Punkt ist, dass mit ComfyUI Fehler nichts kosten, es gibt keine Tokens zu verbrennen. Wir haben gerade erst die Oberfläche dieser Benutzeroberfläche erkundet, und die Community bietet bereits Dutzende zusätzlicher Module, aber in seiner Standardkonfiguration bietet ComfyUI eine solide Plattform, um Bilder mit künstlicher Intelligenz offline zu generieren, und ich denke, jeder, der die entsprechende Hardware besitzt, sollte es ausprobieren.

Offizielle Website und Download: Hier klicken