Remover voz de música

Remova a voz de qualquer música e fique com o instrumental — grátis, sem cadastro, sem upload. O modelo de IA roda no seu navegador, então a música nunca sai do seu aparelho. Uma música de quatro minutos leva cerca de um minuto.

Solte uma música aqui

MP3, WAV, FLAC, OGG, M4A — arquivos de vídeo também funcionam

Como a separação funciona

Você solta uma música e a ferramenta a divide em duas faixas: o instrumental e a voz. Por trás disso há uma rede neural que lê o espectrograma e decide, para cada frequência em cada instante, quanto daquele som pertence a uma voz. Nada é cortado por faixa de frequência como faria um filtro de karaokê — uma voz na mesma região da guitarra é separada dela, e é exatamente por isso que se usa um modelo em vez de um equalizador.

A música fica no seu aparelho

O modelo é baixado para o navegador na primeira vez — 78 MB, uma única vez, depois fica guardado no aparelho. A música em si nunca é enviada a lugar nenhum. Dá para conferir na aba Rede do navegador: não há upload. Todos os outros removedores gratuitos mandam o arquivo para um servidor, e é por isso que precisam limitar você por tamanho e por músicas no dia.

Fazer um playback ou faixa de karaokê

O instrumental que sai é a versão karaokê da música: o acompanhamento intacto e a voz principal removida. É o ponto de partida para cantar por cima, para treinar um instrumento junto da banda original, ou para colocar música sob um vídeo sem uma voz disputando com a narração. As duas faixas voltam com a duração original e sincronizadas.

Onde a separação falha

Separar não é subtrair, é estimar. Reverb pesado na voz já é música do ponto de vista do modelo e parte dele fica no instrumental. Backing vocals e samples de voz saem junto, porque são vozes. E as sibilantes ficam acima da faixa que o modelo analisa, então um pouco permanece. Masterizações densas e muito altas separam pior do que arranjos econômicos.

Se você quer a voz

As duas faixas saem do mesmo processamento, então o acapela está ali ao lado do instrumental e você pode baixar os dois. Se a voz é o que você procura, a página de separação de voz é a mesma ferramenta com o acapela em primeiro lugar.

Abrir o separador de voz

Dividir em quatro faixas

Duas faixas bastam para karaokê e para a maior parte do trabalho de remix. Quando você precisa da bateria sozinha ou de uma linha de baixo sem o resto da banda, o Stem Splitter usa um modelo de quatro saídas: voz, bateria, baixo e todo o resto. Baixa mais e demora mais — 157 MB e cerca de três minutos e meio para uma música de quatro minutos.

Abrir o Stem Splitter
Roda no navegador
Sem upload, sem fila, sem servidor — cerca de um minuto para uma música de quatro minutos.
Nada é enviado
A música não sai do seu aparelho. Verificável na aba Rede: nenhuma requisição de saída.
Grátis, sem conta
Sem cadastro, sem marca d'água, sem limite diário. Instrumental e voz, na duração completa.

Perguntas frequentes

Sim. Sem conta, sem marca d'água, sem limite por música. A ferramenta roda no seu aparelho, então não há custo de servidor por música para repassar — é exatamente por isso que os serviços que processam em servidor precisam limitar você e este não precisa.

Não. O modelo de IA é baixado para o navegador e a separação acontece ali. Você pode confirmar: abra a aba Rede, processe uma música e verá o download do modelo na primeira vez e nada saindo depois disso.

Cerca de um minuto para uma música de quatro minutos num notebook comum, mais 78 MB de modelo baixados uma única vez na primeira visita. Depois disso fica em cache e sobra só o tempo de processamento. Usa um núcleo do processador e não precisa de placa de vídeo.

Boa para karaokê, estudo e a maior parte do trabalho de remix; não o suficiente para passar por um instrumental oficial. Espere um traço de voz nos trechos cheios, alguma sibilante no instrumental e caudas de reverb que ficam para trás.

Dez minutos por arquivo. É menos do que a hora permitida nas outras ferramentas, e o motivo é memória, não política: a separação precisa manter a música inteira sem compressão na aba, mais uma cópia por faixa — cerca de 125 MB por minuto.

Spleeter, o modelo de separação que a Deezer publicou sob licença MIT, convertido para ONNX e executado com onnxruntime no navegador. A licença importa: os modelos de pesquisa mais fortes são publicados apenas para uso científico ou não comercial.