Niedawno rozmawialiśmy o MusicGen, modelu opublikowanym przez Metę do generowania muzyki za pomocą sztucznej inteligencji i tekstu. Jego demo online działa całkiem nieźle, ale wyobrażam sobie, że wielu użytkowników szuka rozwiązania offline. I tu pojawia się portal Samplab, który oferuje nam TextToSample. Ten klient oparty na MusicGen ma prosty i intuicyjny interfejs i wykorzystuje nasze połączenie z internetem tylko raz, aby pobrać właściwy model.
Taniec algorytmów i modeli nie skupia się wyłącznie na tworzeniu obrazów. Powoli działa zaczynają celować w kierunek muzyki. Czy nam się to podoba, czy nie, technologia ma ogromny wpływ na muzykę (np. Auto-Tune), a sztuczna inteligencja nie chce być wyjątkiem. Wystarczy odpowiednie narzędzie, a ludzie z Meta wierzą, że ich model MusicGen jest dobrym rozwiązaniem. Jak się do niego dostać? Są dwie opcje: oficjalne demo online oraz klient TextToSample od Samplab.
TextToSample: narzędzie do tworzenia muzyki lokalnie
Po zainstalowaniu TextToSample musisz wprowadzić pierwszy prompt, aby program automatycznie pobrał model MusicGen. Oficjalna strona potwierdza, że jest to wariant „small”, ale mimo to będziesz musiał uzbroić się w cierpliwość (to ponad dwa gigabajty plików). Po zakończeniu tego procesu możesz wprowadzać kolejne prompty, używać poprzedniego dźwięku, aby „kontynuować” z nim, lub wprost przeciągać i upuszczać własne dźwięki.
Główne kontrolki w TextToSample dotyczą czasu trwania i kontekstu. Pierwsza ma maksymalnie 20 sekund, a druga pomaga określić, jak daleko wstecz model ma „patrzeć”, aby kontynuować melodię. Niezależnie od tych parametrów, wynik zapisywany jest w folderze TextToSample/generated w katalogu Dokumenty, w formacie WAV.
Jeśli chodzi o sprzęt, TextToSample zaleca korzystanie z komputera, ale skorzystał z 16 wątków naszego procesora bez wahania.
TextToSample jest darmowy. Pobierz kopię!
Oficjalna strona i pobieranie: Kliknij tutaj