As inteligências artificiais podem gerar imagens, podem escrever código, podem criar transcrições. Mas sua garantia de sucesso ainda está muito longe. Um dos terrenos mais complexos é o da música: anteriormente exploramos iniciativas como MusicLM, SongR AI (com voz e letra) e TextToSample. Mas quão bom é o algoritmo na hora de separar instrumentos? O projeto free-music-demixer quer descobrir com uma plataforma automática, gratuita e offline.

Como separar instrumentos em uma música com inteligência artificial
Como separar instrumentos em uma música

Separar as fontes de uma música não é algo novo. De fato, remover a voz para criar uma versão karaokê é um dos exemplos mais comuns de separação, mas Android e YouTube eliminaram parte do trabalho pesado. No entanto, não deixa de ser um bom exercício para os novos algoritmos. Com isso em mente, chegamos ao free-music-demixer, uma plataforma de separação de fontes baseada em Open-Unmix e no modelo pré-treinado UMX-L.

Como separar as fontes de uma música com free-music-demixer

Como separar instrumentos em uma música com inteligência artificial
Devemos baixar o modelo antes de começar

O demixer funciona localmente no navegador, e a única descarga necessária é a do modelo, com um tamanho médio de 45 megabytes (não vi nenhum indicador de progresso, então é preciso esperar o site reportar a finalização). O resto é selecionar a música a processar e clicar no botão “Load audio and demix”.

Em poucos minutos, free-music-demixer apresentará cinco arquivos de áudio com seus resultados: Bass, Drums, Vocals, Other e Karaoke. Nem é preciso dizer que os resultados dependem de múltiplos fatores, que vão desde a qualidade original da música até o gênero, passando pelo tempo e pelo tipo de instrumentos presentes. Meus testes foram limitados, mas posso dizer que ele fez um trabalho mais ou menos decente ao isolar a bateria e gerar a versão karaokê.

Como separar instrumentos em uma música com inteligência artificial
Todos os resultados são salvos localmente

Para finalizar, o site inclui uma demo (caso não seja possível executar o modelo por algum motivo) e um modo especial que separa fontes em lote, processando mais de uma música ao mesmo tempo. O desenvolvedor também adverte que free-music-demixer coloca um pouco de pressão extra sobre a CPU e a memória RAM, e que a licença do UMX-L só permite uso sem fins comerciais. Link abaixo!

Site oficial: Clique aqui