Das Entfernen der Stimme aus einem Lied gehört zu den ersten Prozessen, die jeder Musikbegeisterte lernen möchte. Im Laufe der Zeit sind viele Werkzeuge entstanden, aber sie kosten oft Hunderte von Dollar. Die Leute von Deezer haben beschlossen, eine Alternative zu veröffentlichen: Spleeter – eine Engine zur Quellentrennung, die nicht nur die Stimme aus einem Lied entfernen kann, sondern auch andere spezifische Elemente isoliert. Das Tool ist noch sehr neu, aber einige im Web veröffentlichte Ergebnisse sind beeindruckend.
Du magst einen Song. Du besorgst dir eine digitale Kopie. Du öffnest ihn in einem Audio-Editor – ein bisschen hier anpassen, ein bisschen dort... und dann nimmst du einen anderen Song. Du beginnst zu schneiden, änderst Tonhöhe, Amplitude, Tempo und entscheidest, verschiedene Teile zu fusionieren. Du hörst zu und kehrst zum Editor zurück. Hin und her, bis ein Mashup entsteht. Du lädst es auf YouTube hoch (das wahrscheinlich sofort wegen Urheberrechten schreien wird), und wenn du ein wenig Glück hast, wird es viral.
Klingt gut, oder? Das ist ein idealer Fall, in dem alles perfekt klappt. In der Realität muss der Nutzer kämpfen, um gute Samples zu bekommen, und manchmal erfordert das etwas so Einfaches wie das Entfernen der Stimme aus einem Lied. Einige Enthusiasten haben mit Audacity gute Ergebnisse erzielt (mit Betonung auf "einige", denn viele Kommentare beschreiben einen "Unterwasser-Effekt" nach der Verarbeitung), und dann gibt es Plugins, die Stimmen isolieren können, aber sie sind nicht kostenlos (z.B. iZotope RX 7 kostet 399 $ in der Standardausgabe). Heute bietet uns Deezer eine dritte Option: Spleeter.
So entfernst du die Stimme aus einem Lied mit Spleeter
Was macht Spleeter besonders? Maschinelles Lernen. Deezer trainierte den Algorithmus mit seinem Katalog, eine Ressource, auf die andere Forscher und Projekte aus Urheberrechtsgründen keinen Zugriff haben (ganz zu schweigen von Zeit und Energie). Durch die Veröffentlichung ihrer Arbeit in der Community beseitigen sie dieses Gefühl der "unfairen Konkurrenz". Die beiden Hauptfaktoren, die die Reichweite von Spleeter derzeit begrenzen, sind ein relativ komplexen Installationsprozess und das Fehlen einer Benutzeroberfläche. Unter Windows muss zuerst die vollständige Version der Anaconda-Plattform installiert werden, gefolgt von einem Git-Client. Spleeter ist in zwei Versionen erhältlich: eine für Prozessoren und eine, die Grafikkarten nutzt (Nvidia-Hardware benötigt einen kompatiblen CUDA-Treiber).
Die drei Hauptbefehle von Spleeter in der Konsole sind separate zum Trennen von Quellen, train zum Trainieren eines alternativen Trennungsmodells mit einem eigenen Datensatz und evaluation, das das Modell gegen das MusDB-Set testet. Unter den richtigen Bedingungen hat sich Spleeter als sehr schnell erwiesen: Auf einem Xeon-Server mit 32 Kernen und einer GTX 1080 verarbeitete Spleeter die dreieinhalb Stunden musDB in 90 Sekunden. Wenn du nur ein paar Tracks gleichzeitig verarbeiten möchtest, wirst du mit deiner Hardware wahrscheinlich keine Probleme haben.
Die ersten auf Spleeter basierenden Mashups sind bereits im Internet aufgetaucht. Einige sind sehr interessant, während andere besser im Dunkeln geblieben wären. Andy Baio vom Portal Waxy gibt uns eine ziemlich genaue Vorstellung:
Der Rest ist eine Frage des Wartens auf eine benutzerfreundlichere Umgebung für den Durchschnittsnutzer. Das Potenzial von Spleeter zum Entfernen der Stimme aus einem Lied und zum Trennen anderer Quellen ist gigantisch, vor allem weil es kostenlos und open source ist.
Offizielle Ankündigung: Klicke hier | Quelle: Waxy.org
https://old.neoteo.com/musica-para-programadores/