Usuwanie głosu z piosenki prawdopodobnie jest jednym z pierwszych procesów, których chce nauczyć się każdy entuzjasta muzyki. Z biegiem czasu powstawały narzędzia zaprojektowane dla nich, ale zwykle kosztują one setki dolarów. Ludzie z serwisu streamingowego Deezer postanowili uruchomić alternatywę w postaci Spleeter, silnika separacji źródeł, który oprócz usuwania głosu z piosenki potrafi też izolować inne konkretne elementy. Narzędzie jest bardzo nowe, jednak niektóre rezultaty publikowane w sieci robią wrażenie.

Spleeter: nowe narzędzie do usuwania głosu z piosenki
Usuwanie głosu z piosenki

Podoba ci się piosenka. Otrzymujesz cyfrową kopię. Otwierasz ją w edytorze audio. Zmiana tu, poprawka tam… i bierzesz kolejny utwór. Zaczynasz wycinać, modyfikujesz wysokość dźwięku, amplitudę, tempo. Decydujesz się połączyć różne fragmenty, słuchasz i wracasz do edytora. Tam i z powrotem, aż powstanie mashup. Wrzucasz go na YouTube (który z pewnością zacznie krzyczeć o prawa autorskie), a jeśli masz trochę szczęścia, stanie się wiralem.

Brzmi dobrze, prawda? Tyle że to idealny scenariusz, w którym wszystko wychodzi idealnie. W prawdziwym życiu użytkownik musi się namęczyć, żeby zdobyć dobre sample, a czasem wymaga to czegoś tak prostego, jak usunięcie głosu z piosenki. Innymi słowy: separacja źródeł. Część entuzjastów osiągała dobre rezultaty z Audacity (z naciskiem na „część”, bo wiele komentarzy opisuje „efekt podwodny” po przetworzeniu), a są też wtyczki potrafiące izolować głosy, ale nie są darmowe (np. iZotope RX 7 kosztuje 399 dolarów w wersji standardowej). Dziś ludzie z Deezer dają nam trzecią opcję: Spleeter.

Jak usunąć głos z piosenki za pomocą Spleeter

Czym różni się Spleeter? Uczeniem maszynowym. Deezer wytrenował algorytm na swoim katalogu – zasobie, do którego inni badacze i projekty nie mają dostępu ze względu na copyright (nie wspominając o czasie i energii) – i dzieląc się swoją pracą ze społecznością, eliminuje poczucie „nieuczciwej konkurencji”. Dwie główne rzeczy, które na razie ograniczają zasięg Spleeter, to stosunkowo złożony proces instalacji oraz brak interfejsu. W przypadku Windows najpierw trzeba zainstalować pełną edycję platformy Anaconda, a potem klienta git. Spleeter dostępny jest w dwóch wersjach: dla procesorów oraz takiej, która wykorzystuje karty graficzne (sprzęt Nvidia wymaga zgodnego sterownika CUDA).

Trzy główne polecenia Spleeter w konsoli to separate do separacji źródeł, train do trenowania alternatywnego modelu separacji na własnym zestawie danych oraz evaluation, które testuje model na zbiorze MusDB. W odpowiednich warunkach Spleeter okazał się bardzo szybki: na serwerze Xeon z 32 rdzeniami i kartą GTX 1080 przetworzył trzy i pół godziny musDB w 90 sekund. Jeśli planujesz przetwarzać kilka utworów naraz, myślę, że nie będziesz mieć problemów ze swoim sprzętem.

Pierwsze mashupy oparte na Spleeter już pojawiły się w sieci. Niektóre są bardzo ciekawe, inne powinny pozostać w ciemności. Andy Baio z portalu Waxy daje nam dość precyzyjny obraz:

Reszta to kwestia czekania na bardziej przyjazne środowisko dla przeciętnego użytkownika. Potencjał Spleeter do usuwania głosu z piosenki i separowania innych źródeł jest gigantyczny, zwłaszcza że narzędzie jest darmowe i open source.

Oficjalne ogłoszenie: Kliknij tutaj

Źródło: Waxy.org

https://old.neoteo.com/musica-para-programadores/