Po afroamerykańskich nazistach i kleju na pizzy logiczne jest, że Google wykazuje większą rezerwę przy wypuszczaniu produktów ze sztuczną inteligencją. Jednak radar sieci szybko wykrył Imagen 3, nowy generator obrazów z Mountain View. Dostępny przez platformę ImageFX w portalu AI Test Kitchen, Imagen 3 wykorzystuje dynamiczny system promptów, oferując sugestie i modyfikacje za pomocą kilku kliknięć.
Generowanie obrazów za pomocą sztucznej inteligencji powróciło do centrum uwagi. Z jednej strony system Groka wydaje się być poza kontrolą, a z drugiej Google niemal bez hałasu wypuścił swój nowy model Imagen 3. Gigant z Mountain View wspomniał o nim podczas swojej konferencji I/O w maju, a oficjalny paper został opublikowany 13 sierpnia. Początkowo był dostępny dla użytkowników w Stanach Zjednoczonych, ale po szybkiej wizycie na platformie ImageFX w oficjalnym portalu AI Test Kitchen sprawdziłem, że jest już dostępny.
Generowanie obrazów za pomocą modelu Imagen 3 Google
Platforma wymaga jedynie zalogowania się na konto Google. Po tym zabiegu przenosi nas bezpośrednio do interfejsu z sekcją do wprowadzania promptu, kilkoma zalecanymi tagami na dole oraz opcją konfiguracji pozwalającą na zabawę liczbą seed. Jeśli inspiracja postanowi sobie odpocząć, przycisk I’m Feeling Lucky wygeneruje automatyczny prompt.
Imagen 3 ma kilka warstw ochrony i niektóre elementy odrzuca natychmiast (publiczne postacie, nowoczesne uzbrojenie), jednak znalazłem pewne wyjątki. Na przykład model blokował wszystkie żądania dotyczące pistoletu automatycznego, ale nie ma problemów z wygenerowaniem rzymskiego gladiusa czy francuskiego muszkietu w kontekście wystawy. Wyobrażam sobie, że to tylko kwestia czasu, zanim użytkownicy odkryją rysy w jego zbroi.
A co z anatomią? Imagen 3 często popełnia klasyczne błędy, takie jak zbyt długie ramiona i dodatkowe paliczki, ale muszę przyznać, że jej wyniki są lepsze niż Stable Diffusion i dorównują tym, co oferuje FLUX.1. Link poniżej!
Oficjalna strona: Kliknij tutaj
Dostęp do paperu: Kliknij tutaj