L'intelligenza artificiale sa generare immagini, sa scrivere codice e creare trascrizioni. Sta attaccando su molti fronti contemporaneamente, ma la sua garanzia di successo è ancora molto lontana. Uno dei terreni più complessi è la musica: abbiamo già esplorato iniziative come MusicLM, SongR AI (con voce e testo) e TextToSample, ma quanto è bravo l'algoritmo a separare gli strumenti? Il progetto free-music-demixer vuole scoprirlo con una piattaforma automatica, gratuita e offline.

Come separare gli strumenti in una canzone con l'intelligenza artificiale
Come separare gli strumenti in una canzone

Separare le fonti di una canzone non è una novità. Eliminare la voce per creare una versione karaoke è uno degli esempi più comuni, ma Android e YouTube hanno eliminato parte del lavoro pesante. Tuttavia, non smette di essere un buon esercizio per i nuovi algoritmi. Con questo in mente arriviamo a free-music-demixer, una piattaforma di separazione delle fonti basata su Open-Unmix e sul modello pre-addestrato UMX-L.

Come separare le fonti di una canzone con free-music-demixer

Come separare gli strumenti in una canzone con l'intelligenza artificiale
Dobbiamo scaricare il modello prima di iniziare

Il demixer funziona localmente nel browser, e l'unico download necessario è quello del modello, con una dimensione media di 45 megabyte (non ho visto alcun indicatore di avanzamento, quindi bisogna attendere che il sito segnali il completamento). Il resto è solo questione di selezionare la canzone da processare e fare clic sul pulsante «Load audio and demix».

In pochi minuti, free-music-demixer presenterà cinque file audio con i risultati: Bass, Drums, Vocals, Other e Karaoke. Inutile dirlo, i risultati dipendono da molteplici fattori, dalla qualità originale della canzone al genere, passando per il tempo e il tipo di strumenti presenti. I miei test sono stati limitati, ma posso dire che ha fatto un lavoro più o meno decente nell'isolare la batteria e generare la versione karaoke.

Come separare gli strumenti in una canzone con l'intelligenza artificiale
Tutti i risultati vengono salvati localmente

Per finire, il sito include una demo (nel caso in cui non sia possibile eseguire il modello per qualche motivo) e una modalità speciale che separa le fonti in batch, processando più di una canzone alla volta. Il suo sviluppatore avverte anche che free-music-demixer mette un po' di pressione extra su CPU e RAM, e che la licenza di UMX-L consente solo un uso non commerciale. Link qui sotto!

Sito ufficiale: Hai clic qui