Retirer la voix d'une chanson est probablement l'un des premiers processus que tout passionné de musique souhaite apprendre. Avec le temps, des outils ont été conçus pour cela, mais en général ils coûtent des centaines de dollars. Le service de streaming Deezer a décidé de proposer une alternative sous la forme de Spleeter, un moteur de séparation des sources qui, en plus de retirer la voix d'une chanson, peut également isoler d'autres éléments spécifiques. L'outil est très récent, mais certains résultats publiés sur le Web sont impressionnants.

Spleeter : un nouvel outil pour retirer la voix d'une chanson
Retirer la voix d'une chanson

Vous aimez une chanson. Vous en obtenez une copie numérique. Vous l'ouvrez dans un éditeur audio. Un changement ici, un ajustement là... puis vous prenez une autre chanson. Vous commencez à couper, vous modifiez la hauteur, l'amplitude, le tempo. Vous décidez de fusionner différentes parties, vous écoutez et revenez à l'éditeur. Aller-retour jusqu'à ce qu'un mashup naisse. Vous le téléchargez sur YouTube (qui commencera sûrement à crier au copyright), et si vous avez un peu de chance, il deviendra viral.

Ça semble bien, non ? Il se trouve que c'est un cas idéal où tout se passe parfaitement. Dans la vie réelle, l'utilisateur doit se battre pour obtenir de bons échantillons, et parfois, cela nécessite quelque chose d'aussi direct que retirer la voix d'une chanson. En d'autres termes, séparer les sources. Certains passionnés ont obtenu de bons résultats avec Audacity (accent sur « certains », car de nombreux commentaires décrivent un « effet sous-marin » après le traitement), et il existe des plugins capables d'isoler les voix, mais ils ne sont pas gratuits (par exemple, iZotope RX 7 coûte 399 dollars dans son édition standard). Aujourd'hui, Deezer nous offre une troisième option : Spleeter.

Comment retirer la voix d'une chanson avec Spleeter

Qu'est-ce qui rend Spleeter différent ? L'apprentissage automatique. Deezer a entraîné l'algorithme en utilisant son catalogue, une ressource à laquelle d'autres chercheurs et projets ne peuvent tout simplement pas accéder pour des raisons de droits d'auteur (sans oublier le temps et l'énergie), et en partageant son travail avec la communauté, il élimine ce sentiment de « concurrence déloyale ». Les deux principaux détails qui limitent actuellement la portée de Spleeter sont un processus d'installation relativement complexe et l'absence d'interface. Dans le cas spécifique de Windows, il faut d'abord installer l'édition complète de la plateforme Anaconda, puis un client git. Spleeter est disponible en deux versions, une pour les processeurs, et une autre qui exploite les cartes graphiques (le matériel Nvidia nécessite un pilote CUDA compatible).

Les trois commandes principales de Spleeter dans la console sont separate pour séparer les sources, train pour entraîner un modèle de séparation alternatif avec son propre jeu de données, et evaluation, qui teste le modèle par rapport à l'ensemble MusDB. Dans des conditions appropriées, Spleeter s'est avéré très rapide : sur un serveur Xeon à 32 cœurs avec une GTX 1080, Spleeter a mâché les trois heures et demie de musDB en 90 secondes. Si vous prévoyez de traiter quelques pistes à la fois, je suppose que vous n'aurez pas de problème avec votre matériel.

Les premiers mashups basés sur Spleeter sont déjà apparus sur le Web. Certains sont très intéressants, tandis que d'autres devraient rester dans l'ombre. Andy Baio du portail Waxy nous donne une idée assez précise :

Le reste est une question d'attendre un environnement plus convivial pour l'utilisateur moyen. Le potentiel de Spleeter pour retirer la voix d'une chanson et séparer d'autres sources est gigantesque, surtout étant gratuit et open source.

Annonce officielle : Cliquez ici — Source : Waxy.org.

https://old.neoteo.com/musica-para-programadores/