W ostatnich godzinach firma Stability.ai ogłosiła premierę nowego modelu „Stable Diffusion 3 Medium”, który (podobno) ma dwa miliardy parametrów, dokładniejsze rozumienie promptów i ogólne ulepszenia w takich aspektach jak fotorealizm. Model ten stawia także na działanie w środowiskach z ograniczoną ilością VRAM, ale jeśli chcesz sprawdzić, co potrafi, zanim cokolwiek pobierzesz, w HuggingFace znajdziesz już darmowe przestrzenie

Przyznaję, że jestem odcięty od generowania obrazów ze sztuczną inteligencją. Po uzyskaniu setek tysięcy wyników z Auto1111 i modelami dostępnymi na Civitai, nieuchronnie zaczyna się rozpoznawać wzorce, błędy i ograniczenia. Do tego dochodzą wymagania sprzętowe: bardziej złożone modele potrzebują więcej VRAM, a jedyną alternatywą dla wielu użytkowników było odświeżanie starych modeli.

W ten sposób docieramy do Stable Diffusion 3 Medium, które teoretycznie otrzymało wiele optymalizacji, aby działać na komercyjnym sprzęcie. W mojej głowie oznacza to „każdy GPU z 8 GB VRAM lub mniej”, ale zamiast podawać linki do poradników instalacji i pobierania, dziś polecam coś znacznie prostszego: odwiedź HuggingFace i przetestuj darmowe wersje demonstracyjne Stable Diffusion 3 Medium online.

Testujemy Stable Diffusion 3 Medium online i za darmo

Jak generować obrazy z nowym Stable Diffusion 3 Medium online
Jak generować obrazy z nowym Stable Diffusion 3 Medium online
Jak generować obrazy z nowym Stable Diffusion 3 Medium online
Jak można było się spodziewać, modele są pod ostrzałem

Dlaczego? Cóż… na Reddicie go niszczą. Model ma być lepszy w generowaniu fotorealistycznych obrazów, co jest prawdą, jeśli odtwarzamy krajobrazy lub struktury, ale problem pojawia się, gdy w grę wchodzą ludzie. „Stare sztuczki” wydają się działać dobrze (ręce w kieszeniach lub za plecami, rozbudowane negatywne prompty itd.), ale bardzo trudno zaakceptować, że te modele wciąż popełniają te same błędy po tak długim czasie, podczas gdy konkurenci mają już (przynajmniej) rok generowania poprawnych rąk.

Jak generować obrazy z nowym Stable Diffusion 3 Medium online
«highly detailed image of an abandoned military bunker in the middle of the desert. Daylight in the deep desert, heat, bright blue sky. Rusted metal and crumbling concrete, broken walls, exposed beams, post-apocalyptic environment.»
Jak generować obrazy z nowym Stable Diffusion 3 Medium online
«professional photography of a caucasian woman waiting in a bus stop. Wearing a long deep blue coat, hands in her pocket, small white wool winter hat, green scarf. Short pixie black hair, green eyes, looking at the camera. Rainy winter day, moisture, cold.»

Użytkownicy obwiniają „nadmierną cenzurę” ze strony Stability.ai (co miało już miejsce w poprzednich wersjach), ale inni przypisują jakość modelu problemom finansowym firmy. Polityka wewnętrzna na bok, jeśli chcesz przetestować własne prompty w Stable Diffusion 3 Medium, kliknij w poniższy link, wybierz jeden z dostępnych „Spaces”… i uzbrój się w cierpliwość. Momentami bardzo trudno uzyskać dostęp do wolnego GPU…

Przetestuj Stable Diffusion 3 Medium: Kliknij tutaj