W naszym artykule o najlepszych generatorach obrazów z wykorzystaniem sztucznej inteligencji przyznajemy, że lokalne środowiska nie są dla każdego… ale nie można zaprzeczyć ich wyższości. Brak limitów i możliwość korzystania z wielu modeli całkowicie zmieniają zasady gry, jednak bez dobrego interfejsu to wszystko na nic. I tu pojawia się ComfyUI, które czerpie inspirację z modularnych projektów i diagramów przepływu, oferując znacznie bardziej intuicyjne doświadczenie.

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Generowanie obrazów z Stable Diffusion offline

Rozpuszczając granice

Darmowe usługi, które niedawno udostępniliśmy działają bardzo dobrze i są świetnym punktem startowym dla każdego, kto chce generować obrazy bez pobierania czegokolwiek. Ale ich ostatecznym celem jest to, aby pieniądze zmieniły właściciela, i w tym celu narzucają szereg ograniczeń, wśród których wyróżniają się dzienny limit tokenów, dostępność modeli i oczywiście rodzaj obrazów, które możemy generować.

Modele offline oparte na Stable Diffusion wyrywają to wszystko z korzeniami. Gdy pokonamy główną trudność (karta graficzna Nvidia z odpowiednią ilością VRAM), otwiera się szeroki wachlarz możliwości: alternatywne modele, wysoka rozdzielczość, inpainting, upscaling, krzyżowanie modeli i wiele więcej. Teraz pierwszym zaleceniem w tych przypadkach jest Automatic1111 (który ma lepsze wsparcie dla GPU AMD i Intel), ale istnieje też ComfyUI, i to właśnie to zbadamy dzisiaj.

Jak zainstalować ComfyUI do generowania obrazów z Stable Diffusion offline

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Konsola jest naszym przyjacielem. ComfyUI nie pobiera żadnych zależności, ale potrzebuje podwyższonych uprawnień.

Jednym z najbardziej pozytywnych aspektów ComfyUI jest to, że jest gotowy do użycia w pliku .7z o rozmiarze 1,4 gigabajta. Wszystkie jego zależności są zawarte, a jedyne co musimy zrobić (oprócz rozpakowania zawartości) to uruchomić plik run_nvidia_gpu.bat lub run_cpu.bat (to włącza użycie CPU, ale będzie działać bardzo wolno) z konsoli systemowej z podwyższonymi uprawnieniami.

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
ComfyUI nie zawiera modeli, ale Civitai ma wszystko, czego potrzebujemy i więcej

Ale zanim do tego dojdziemy, musimy pobrać kompatybilny model. ComfyUI działa ze wszystkimi wersjami Stable Diffusion, jednak najlepszą sugestią jest odwiedzenie Civitai, znalezienie modelu, który przyciągnie uwagę, i pobranie go. Ilość materiału NSFW jest tam bardzo duża, więc nie jest dobrym pomysłem korzystanie z publicznego lub służbowego sprzętu. Modele wahają się od 1,5 do 6,5 gigabajta i są przechowywane w podfolderze ComfyUI\models\checkpoints. Nie ma znaczenia, czy są to „Checkpoints" czy „SafeTensors" (zalecane), oba działają w ten sam sposób.

Pierwsze użycie ComfyUI

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Spokojnie...

Po rozpakowaniu zawartości i umieszczeniu modelu we właściwym podfolderze nadszedł czas, aby otworzyć run_nvidia_gpu.bat. Jeśli wszystko pójdzie dobrze, w domyślnej przeglądarce otworzy się karta z adresem http://127.0.0.1:8188/, prezentując interfejs ComfyUI.

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Interfejs pozwala nam zmienić kolor niektórych modułów. Tutaj użyliśmy zielonego dla promptu i czerwonego dla negatywnego promptu.

Nie ma się czym martwić. Wygląda, jakby zaprojektował go kosmita, ale ma dużo logiki. Ta standardowa konfiguracja umożliwia wszystko, czego potrzebujemy do generowania obrazów niemal natychmiast, i wymaga tylko kilku poprawek.

  • Moduł Load Checkpoint pozwala nam wybrać zainstalowane modele. Tutaj musimy kliknąć strzałki, aż pojawi się nazwa modelu, który pobraliśmy z Civitai. Trzy punkty z ich połączeniami, oznaczone jako Model, CLIP i VAE, pozostają nietknięte.
  • W tym przykładzie są dwa moduły o nazwie CLIP Text Encode i są identyczne, z wyjątkiem jednej istotnej różnicy: jeden ma warunek pozytywny (czyli „to, co chcemy zobaczyć" na obrazie), a drugi warunek negatywny („czego nie chcemy widzieć"). Tutaj ładujemy prompty, a połączenia Conditioning idą odpowiednio do Positive i Negative.
Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Moduł KSampler pomaga nam zdefiniować zaawansowane parametry generowania
  • Moduł Empty Latent Image tylko ustawia końcową rozdzielczość obrazów i jak duża powinna być partia. Jeśli wybierzemy bardzo wysokie wartości w obu polach, wzrasta ryzyko przeciążenia dostępnej pamięci VRAM. Trzeba eksperymentować.
  • To samo dotyczy modułu o nazwie KSampler. Tutaj dzieje się magia: KSampler umożliwia kontrolę seed i sposób jego przetwarzania (randomize jest idealne), liczbę kroków, guidance lub intensywność (CFG), sampler, scheduler i poziom denoise. Osobiście wolę zwiększyć kroki do 30 i obniżyć CFG do 7. Kombinacja euler/normal jest odpowiednia na początek, a denoise powinien wynosić 1.00 przy nowych generacjach.
Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Ostatnie moduły prawie nie wymagają interwencji użytkownika
  • Ostatnie dwa moduły to VAE Decode, który przekształca chaos latentny w prawdziwe obrazy (nie wymaga interwencji użytkownika), oraz Save Image, który automatycznie zapisuje wszystkie wyniki w folderze ComfyUI/output i prezentuje je w mini-galerii. Kliknięcie Queue Prompt rozpocznie generowanie.

Ad infinitum

Jak używać ComfyUI do generowania obrazów z Stable Diffusion offline
Przy generowaniu offline błędy nie kosztują tokenów

Czy obrazy nie są dobre? Wystarczy spróbować ponownie i ponownie, i ponownie... tyle razy, ile trzeba. Wolność od tokenów pozwala nam robić to aż do znudzenia, testować nowe modele, dodawać LoRA, embeddingi i inwersje tekstowe... ale to inna historia.

Sedno w tym, że z ComfyUI błędy nie kosztują, nie ma tokenów do spalenia. Dopiero zbadaliśmy powierzchnię tego interfejsu, a społeczność oferuje już dziesiątki dodatkowych modułów, ale w konfiguracji default, ComfyUI zapewnia solidną platformę do generowania obrazów z AI offline, i myślę, że każdy, kto ma odpowiedni sprzęt, powinien spróbować.

Oficjalna strona i pobieranie: Kliknij tutaj