Niedawno rozmawialiśmy o MusicGen, modelu opublikowanym przez Metę do generowania muzyki za pomocą sztucznej inteligencji i tekstu. Jego demo online działa całkiem nieźle, ale wyobrażam sobie, że wielu użytkowników szuka rozwiązania offline. I tu pojawia się portal Samplab, który oferuje nam TextToSample. Ten klient oparty na MusicGen ma prosty i intuicyjny interfejs i wykorzystuje nasze połączenie z internetem tylko raz, aby pobrać właściwy model.

TextToSample: Jak generować muzykę za pomocą sztucznej inteligencji na swoim PC
Jak generować muzykę za pomocą sztucznej inteligencji na swoim PC

Taniec algorytmów i modeli nie skupia się wyłącznie na tworzeniu obrazów. Powoli działa zaczynają celować w kierunek muzyki. Czy nam się to podoba, czy nie, technologia ma ogromny wpływ na muzykę (np. Auto-Tune), a sztuczna inteligencja nie chce być wyjątkiem. Wystarczy odpowiednie narzędzie, a ludzie z Meta wierzą, że ich model MusicGen jest dobrym rozwiązaniem. Jak się do niego dostać? Są dwie opcje: oficjalne demo online oraz klient TextToSample od Samplab.

TextToSample: narzędzie do tworzenia muzyki lokalnie

TextToSample: Jak generować muzykę za pomocą sztucznej inteligencji na swoim PC
Zanim zaczniesz, program pobierze model

Po zainstalowaniu TextToSample musisz wprowadzić pierwszy prompt, aby program automatycznie pobrał model MusicGen. Oficjalna strona potwierdza, że jest to wariant „small”, ale mimo to będziesz musiał uzbroić się w cierpliwość (to ponad dwa gigabajty plików). Po zakończeniu tego procesu możesz wprowadzać kolejne prompty, używać poprzedniego dźwięku, aby „kontynuować” z nim, lub wprost przeciągać i upuszczać własne dźwięki.

TextToSample: Jak generować muzykę za pomocą sztucznej inteligencji na swoim PC
Oczekiwanie nie było długie, ale nasz procesor bardzo pomógł
„classic mexican guitar, mariachi inspired, consistent, dynamic sound”
„fast electropunk sound with hard bass, cyberpunk inspired”
„high energy synthpop”

Główne kontrolki w TextToSample dotyczą czasu trwania i kontekstu. Pierwsza ma maksymalnie 20 sekund, a druga pomaga określić, jak daleko wstecz model ma „patrzeć”, aby kontynuować melodię. Niezależnie od tych parametrów, wynik zapisywany jest w folderze TextToSample/generated w katalogu Dokumenty, w formacie WAV.

Jeśli chodzi o sprzęt, TextToSample zaleca korzystanie z komputera, ale skorzystał z 16 wątków naszego procesora bez wahania.

TextToSample jest darmowy. Pobierz kopię!

Oficjalna strona i pobieranie: Kliknij tutaj