Die Entwicklungen rund um die Generierung von Bildern mit Künstlicher Intelligenz schreiten weiter voran. Wir haben mobile Anwendungen, Tiefeneffekte, Video und Animation, aber wir sollten die Schnittstellen für die lokale Ausführung von Modellen nicht vergessen. Im speziellen Fall von Stable Diffusion ist die Lösung von Automatic1111 die kompatibelste und flexibelste, aber wenn Sie eine intuitive und benutzerfreundliche Umgebung bevorzugen, mit hervorragenden Funktionen zum Erweitern von Bildern über ihre ursprüngliche Größe hinaus, müssen Sie sich InvokeAI genauer ansehen.
Es gibt mindestens drei Wege, um Bilder mit Künstlicher Intelligenz zu generieren. Zum einen haben wir DALL-E, mit Craiyon als einer seiner besten kostenlosen Online-Optionen. Dann erscheint Midjourney, extrem beliebt in sozialen Netzwerken, aber es erfordert Discord und den Kauf von Tokens. Schließlich kommen wir zu Stable Diffusion, das neben einem kostenlosen Online-Modus auch seine Offline-Ausführung mit einer Grafikkarte ermöglicht.
In den ersten Tagen lief alles in der Systemkonsole, aber das Projekt von Automatic1111 führte zu einer Weboberfläche für Stable Diffusion mit hoher Kompatibilität und Flexibilität. Allerdings müssen wir auch anerkennen, dass der Zustand von Automatic1111 ein wenig chaotisch ist, mit mehr als 1.300 offenen Issues auf GitHub und einer nicht ganz optimalen Dokumentation. Wenn Sie nun genügend Feuerkraft haben, um Stable Diffusion offline auszuführen, und nach einer Alternative zur Automatic1111-Oberfläche suchen, zeigen alle Pfeile auf InvokeAI.
InvokeAI: Eine der besten Weboberflächen für Stable Diffusion
Einer der positivsten Aspekte von InvokeAI ist seine Installation. Die Hauptanforderungen sind drei: die Installation von Python (3.10.6 ist eine gute Option, da es die Kompatibilität mit Automatic1111 beibehält), das Anwenden eines Patches in der Registrierung, der längere Laufwerkspfade aktiviert, und etwa 25 GB Speicherplatz auf der Festplatte. Ein Doppelklick auf install.bat startet den Prozess selbst, aber er ist nicht zu 100 Prozent automatisch. InvokeAI fragt nach dem Ziel der Dateien und den zu installierenden Modellen (die empfohlene Liste ist ein guter Ausgangspunkt). Offensichtlich bedeutet dies, dass InvokeAI sehr große Dateien herunterladen wird, also Geduld.
Bei weitem die leistungsstärkste Funktion von InvokeAI ist die Unified Canvas, die Funktionen von Inpainting, Outpainting, Text-zu-Bild und Bild-zu-Bild kombiniert. Sowohl das Inpainting (Ändern oder Regenerieren bestimmter Teile eines Bildes) als auch das Outpainting (Erweitern eines Bildes mit zusätzlichen Details) lassen in der Automatic1111-Oberfläche zu wünschen übrig, aber es ist klar, dass InvokeAI mit seiner neuesten Ausgabe ins Schwarze getroffen hat.
Trotz dieser beeindruckenden Funktionen hat InvokeAI Einschränkungen, die wir hervorheben müssen. Die erste ist die Anzahl der Tokens (mit anderen Worten, wenn unser Prompt zu lang ist, ignoriert InvokeAI den Überschuss), aber die wichtigste ist seine mangelnde Effizienz bei der VRAM-Nutzung, so sehr, dass ich empfehle, InvokeAI vollständig zu ignorieren, wenn die Grafikkarte über 6 GB VRAM oder weniger verfügt. In diesem Fall ist die beste Option, zu Automatic1111 zurückzukehren und die Befehle --medvram oder --lowvram zu aktivieren, die sehr gut funktionieren (abgesehen von der Leistungseinbuße).
Offizielle Website: Hier klicken