Ir para o conteúdo

Tutorial LALAL.AI: Como Separar Voz e Stems

Darius Z. Por Darius Z. Atualizado: 12 min de leitura
Tutorial LALAL.AI mostrando visualização de forma de onda e interface do fluxo de separação de stems

Contém links de afiliados

Neste tutorial do LALAL.AI você aprende a separar voz, bateria, baixo, guitarras, piano, sintetizador, cordas e sopros de qualquer música com IA. O motor padrão é o v6 Andromeda, e as redes v5 Perseus e v4 Orion continuam disponíveis em Settings. Cada faixa leva menos de 60 segundos, o serviço aceita MP3, WAV, FLAC e arquivos de vídeo, e o resultado sai limpo no navegador, no app de desktop ou no celular.

Quer montar um karaokê, remixar, samplear instrumentos ou estudar com as partes isoladas? Este guia passo a passo cobre desde a remoção simples de voz até a separação em vários stems. Para ver como a ferramenta paga se comporta diante de um separador gratuito de navegador, leia LALAL.AI vs Vocal Remover.

Pontos Principais

  • O seletor do LALAL.AI lista 11 opções de separação: vocal e instrumental, bateria, baixo, voz e ruído, guitarras, guitarra elétrica, violão, piano, sintetizador, cordas e sopros
  • O plano gratuito Starter oferece 10 minutos de processamento, só com prévia (sem downloads)
  • Arquivos-fonte de maior qualidade produzem separações mais limpas
  • O v6 Andromeda é o motor padrão para voz, bateria, baixo, piano e guitarras; o v5 Perseus e o v4 Orion seguem disponíveis em Settings
  • Usos comuns incluem faixas de karaokê, remixes, sampling, estudo e criação de conteúdo
LALAL.AI ★★★★☆★ 4.6 A partir de €6,75/mês
Experimente LALAL.AI Grátis

Experimente o LALAL.AI grátis

O plano gratuito Starter dá 10 minutos de processamento e a prévia de cada stem, então você ouve a separação antes de pagar qualquer coisa.

Experimente LALAL.AI grátis →

O que você vai precisar

São três coisas: uma conta no LALAL.AI, um arquivo de áudio ou vídeo e um plano pago se quiser ficar com o resultado. O cadastro é gratuito e não pede cartão. O plano gratuito Starter libera 10 minutos de processamento e uploads de até 200 MB, mas apenas toca a prévia para você. O download começa no Lite.

  • Conta LALAL.AI

    Grátis para criar, sem cartão de crédito no cadastro

  • Arquivo de áudio ou vídeo

    MP3, WAV, FLAC, MP4: qualquer música ou gravação que você queira separar

  • Plano pago (para downloads)

    A partir de €6,75/mês (anual). Contas gratuitas só ouvem a prévia

O plano Lite do LALAL.AI custa €8,99/mês, ou €6,75/mês na cobrança anual, com 90 minutos de Fast Queue por mês. O Pro sai por €17,99/mês, ou €13,5/mês no anual, com 250 minutos de Fast Queue e processamento offline pelo Lyra, o modelo local do LALAL.AI que roda no seu próprio hardware sem enviar nada para a nuvem.

Quais tipos de stem o LALAL.AI pode separar?

O seletor traz 11 opções de separação, do corte simples entre vocal e instrumental até bateria, baixo, piano, guitarras, sintetizador, cordas e sopros. A opção de guitarras junta todas as guitarras da faixa em um stem só, seja elétrica ou acústica. Cada opção roda como uma passagem própria, então um desdobramento em quatro stems significa quatro processamentos.

Tipo de stem O que extrai Ideal para
Vocal e instrumental Canto ou rap em relação à base Karaokê, remixes
Voz e ruído Fala em relação a sons de fundo Limpeza de podcast
Bateria Kit completo (bumbo, caixa, pratos) Sampling, estudo
Baixo Baixo elétrico e frequências graves Estudo de baixo, remixes
Piano Piano e teclados Transcrição, estudo
Guitarras Todas as guitarras da faixa, elétricas ou acústicas, em um stem Tirar a guitarra rápido sem escolher o tipo
Guitarra elétrica Guitarra elétrica em específico Estudo de guitarra
Violão Partes de violão Arranjos acústicos
Sintetizador Sintetizadores e sons eletrônicos Produção EDM
Cordas Seções de cordas orquestrais Sampling clássico
Sopros Metais e madeiras Arranjos de jazz
Caixa de upload do Stem Splitter do LALAL.AI com a lista de stems aberta, de Vocal and Instrumental até Wind
O seletor de stems no app web, aberto antes do upload. Guitars é a entrada mais recente, e a lista chega a onze opções quando você conta Voice and Noise.
Informação:

Dois arquivos por separação: Cada separação gera o elemento isolado e tudo menos aquele elemento. Na separação vocal/instrumental você recebe acapella e versão karaokê.

Como separar a voz com o LALAL.AI?

São seis etapas: preparar um arquivo-fonte de boa qualidade, enviar com o tipo de stem já escolhido, ajustar a rede neural e o processamento, ouvir a prévia de 30 segundos, processar a faixa inteira e baixar os stems. Uma música de três ou quatro minutos termina em 15 a 60 segundos na Fast Queue.

1

Prepare o arquivo-fonte

Qualidade que entra, qualidade que sai. Quanto melhor a fonte, mais limpa a separação.

Melhores formatos (em ordem):

Formato Qualidade Resultado esperado
WAV/FLAC (lossless) ★★★★★ Melhor: separação mais limpa
MP3 320 kbps ★★★★☆ Muito bom: poucos artefatos
MP3 256 kbps ★★★☆☆ Bom: alguns artefatos possíveis
MP3 128 kbps ★★☆☆☆ Aceitável: artefatos perceptíveis

Onde conseguir arquivos de qualidade:

  • Comprar em iTunes, Amazon, Bandcamp (qualidade maior)
  • CDs originais ripados para WAV/FLAC
  • Lançamentos de produtores (stems, se houver)
  • Rips de streaming costumam ser piores
Informação:

Limite de tamanho: contas gratuitas podem enviar até 200 MB; pagas, até 2 GB. Um WAV típico de 4 minutos tem cerca de 40 MB, então isso raramente atrapalha.

2

Envie seu arquivo

Escolha a plataforma e faça upload do áudio ou vídeo

Na web:

  1. Acesse lalal.ai
  2. Localize a área de upload na página inicial
  3. Escolha o tipo de stem antes de enviar (importante!)
  4. Clique em Selecionar arquivos ou arraste o arquivo
  5. Aguarde o fim do upload

No app de desktop:

  1. Baixe o app para Mac ou Windows no LALAL.AI
  2. Abra o app e faça login
  3. Selecione o tipo de stem
  4. Arraste os arquivos para o app
  5. O upload começa automaticamente

No celular:

  1. Baixe na App Store ou Google Play
  2. Abra e faça login
  3. Selecione o tipo de stem
  4. Escolha o arquivo no dispositivo
  5. Envie para os servidores do LALAL.AI

O LALAL.AI aceita áudio em MP3, OGG, WAV, FLAC, AIFF, AAC e M4A, além de vídeos em AVI, MP4, MKV, MOV e M4V. Os planos pagos processam até 20 arquivos em lote no mesmo upload.

3

Ajuste as configurações

Defina rede neural e opções de processamento para o melhor resultado

Escolha da rede neural

Clique no ícone de engrenagem no canto superior direito da caixa de upload para abrir as opções avançadas: rede neural, nível de cancelamento de ruído, processamento aprimorado e redução de reverberação e eco na voz.

Janela Settings do LALAL.AI com as redes v6 Andromeda, v5 Perseus e v4 Orion e as opções de ruído e processamento
O painel Settings, atrás do ícone de engrenagem. O Andromeda já vem marcado, o Perseus e o Orion ficam logo abaixo para os stems que ele ainda não cobre, e o nível de ruído e o Enhanced Processing estão na mesma tela.
Motor Ideal para Recomendação
v6 Andromeda (padrão) Voz, instrumental, bateria, baixo, piano, guitarras Comece por aqui; guitarras e o piano refeito chegaram em agosto de 2026
v5 Perseus Sintetizador, cordas, sopros; alternativa para qualquer stem Troque para cá se a separação do Andromeda soar estranha
v4 Orion Resultados legados para material antigo Uso pontual

O Lynx, uma rede separada de isolamento de voz, é o que roda no stem de voz e ruído e no Voice Cleaner.

Nível de cancelamento de ruído

Escolha entre Mild, Normal e Aggressive conforme o ruído de fundo da gravação. O Aggressive tira mais ruído, mas pode comprometer a voz em gravações que já são limpas.

Processamento aprimorado

  • Clear Cut

    Reduz vazamento entre stems. Mais limpo, mas pode perder detalhe. Ótimo para karaokê e sampling.

  • Deep Extraction

    Captura mais detalhe, com leve vazamento possível. Melhor para remix quando você quer cada nuance.

Redução de reverberação e eco na voz (De-Echo)

Se a gravação original tiver reverberação:

  • Ative a redução de reverberação e eco na voz (De-Echo) para um isolamento vocal mais limpo
  • Especialmente útil em gravações ao vivo ou em faixas muito produzidas
4

Ouça a prévia

Ouça cada stem antes de gastar minutos na separação completa

Como pré-visualizar:

  1. Depois do processamento, aparecem as formas de onda de cada stem
  2. Clique em play em cada stem
  3. Ouça uma prévia de 30 segundos de cada saída
  4. Navegue pela faixa para ouvir trechos diferentes

No que prestar atenção:

No vocal isolado:

  • Clareza da voz
  • Artefatos ou som aquoso
  • Vazamento de instrumentos (principalmente bateria)

No instrumental:

  • Frequências faltando (som fino)
  • Restos de voz
  • Equilíbrio geral em relação ao original

Se o resultado for ruim:

  • Teste outra rede neural
  • Alterne o modo de processamento aprimorado
  • Verifique se o arquivo-fonte é de baixa qualidade
  • Experimente outra versão da música
Sucesso:

Dica de prévia: concentre-se no refrão e nas partes mais densas, onde a separação costuma ser mais difícil. Se ali soar bem, o restante tende a acompanhar.

5

Processe o arquivo inteiro

Gostou da prévia? Hora de processar a faixa completa

  1. Clique em Split in Full
  2. Escolha o formato de saída:
    • Same as input (recomendado)
    • Ou: MP3, WAV, FLAC, OGG, AAC, AIFF
  3. Confirme o processamento
  4. Aguarde a separação (em geral 15 a 60 segundos)

Tipos de fila:

  • Fast Queue: processamento imediato (consome minutos mensais)
  • Relaxed Queue: espera disponibilidade no servidor (ilimitada nos planos pagos)
6

Baixe os stems

Receba os arquivos de áudio separados

Quando o processamento terminar:

  1. Aparecem botões de download para cada stem
  2. Baixe stems individuais
  3. Ou use Download All para um ZIP

Nomes dos arquivos:

  • original_name_vocals.mp3: vocal isolado
  • original_name_no_vocals.mp3: instrumental / karaokê
Aviso:

Observação: o download exige plano pago. Contas gratuitas só podem ouvir a prévia.

Faça sua primeira separação no LALAL.AI

Agora você já sabe quais configurações importam. Envie uma faixa, escolha o tipo de stem e ouça o que o v6 Andromeda tira dela.

Continuar com LALAL.AI →

Exemplos práticos

As quatro tarefas que levam alguém a um separador de stems são karaokê, material para remix, samples de bateria e limpeza de podcast. Cada uma combina um tipo de stem com um ajuste de processamento aprimorado: Clear Cut quando o vazamento entre stems estragaria o resultado, Deep Extraction quando você quer preservar cada nuance.

  • Faixa de karaokê

    Envie a música, selecione 'Vocal e instrumental', use Clear Cut e baixe o stem instrumental

  • Produção de remix

    Envie, escolha 'Vocal e instrumental', ative Deep Extraction e De-Echo e importe o vocal na sua DAW

  • Sampling de bateria

    Envie, selecione 'Bateria', use Deep Extraction e corte os samples no seu sampler

  • Limpeza de podcast

    Envie o áudio, escolha 'Voz e ruído', use cancelamento de ruído Aggressive e receba o diálogo limpo

Montando faixas para estudo

Instrumento Stem a selecionar O que você obtém
Estudo de baixo Baixo Faixa sem o baixo para tocar por cima
Estudo de guitarra Guitarra elétrica ou violão Faixa sem guitarra para tocar junto
Estudo de bateria Bateria Faixa sem bateria para praticar
Estudo de piano Piano Base sem piano

Como funciona a separação multi-stem?

O LALAL.AI separa um elemento por passagem, então um desdobramento em quatro partes significa rodar o mesmo arquivo quatro vezes, escolhendo um tipo de stem diferente a cada rodada. Cada passagem consome minutos equivalentes à duração do arquivo e devolve dois arquivos: o stem isolado e todo o resto.

Passagem Tipo de stem O que você obtém
1ª Vocal e instrumental Acapella + faixa karaokê
2ª Bateria Bateria isolada + versão sem bateria
3ª Baixo Baixo isolado + versão sem baixo
4ª Piano (se houver) Piano isolado + versão sem piano
Informação:

Uso de créditos: cada passagem consome minutos iguais à duração do arquivo. Uma música de 4 minutos em 4 tipos de separação usa 16 minutos no total. Os 250 minutos da Fast Queue do plano Pro cobrem cerca de 60 músicas completas com separação em 4 stems cada.

Como obter os melhores resultados com o LALAL.AI?

Comece por uma fonte lossless, deixe o v6 Andromeda selecionado para voz, bateria, baixo, piano e guitarras, e mude para o v5 Perseus em sintetizador, cordas e sopros. O Clear Cut compra separação em troca de detalhe; o Deep Extraction faz o contrário. Vale ligar o De-Echo em qualquer coisa com reverberação.

  • Vocais mais limpos

    Fonte na melhor qualidade + v6 Andromeda + De-Echo + modo Clear Cut

  • Instrumentais mais cheios

    Modo Deep Extraction + v6 Andromeda para bateria, baixo, piano e guitarras (v5 Perseus para sintetizador, cordas e sopros) + aceitar leves restos de voz + fonte lossless

  • Bateria melhor

    Baterias secas e marcadas separam melhor. Eletrônica costuma sair mais limpa; ao vivo pode haver vazamento

Dicas por gênero:

Gênero Motor recomendado Modo de processamento Observações
Pop v6 Andromeda Clear Cut Resultados mais consistentes no geral
Rock v6 Andromeda Deep Extraction Preserva texturas de guitarra
Eletrônico/EDM v5 Perseus (synth) / v6 Andromeda (voz) Clear Cut Separação limpa de sintetizadores
Hip-hop v6 Andromeda Clear Cut + De-Echo Clareza para samples de voz
Clássico v5 Perseus (cordas, sopros) Deep Extraction Orquestra complexa
Jazz v5 Perseus (instrumentos) Deep Extraction Som acústico natural

Nos gêneros brasileiros de percussão densa, como samba, pagode e forró, quem decide é a prévia: compare v6 Andromeda e v5 Perseus nos 30 segundos antes de gastar minutos na faixa inteira.

Solução de problemas comuns

Problema Causa Soluções
Voz aquosa ou com fase Artefatos da IA em separações difíceis Teste outra rede neural; use fonte de maior qualidade; experimente Deep Extraction
Instrumental fino A remoção agressiva da voz levou frequências junto Use Deep Extraction; equalize na DAW; teste o v5 Perseus
Bateria vazando no vocal Transientes difíceis de separar Use Clear Cut; reduza transientes no pós; aceite vazamento leve
Processamento muito lento Servidor cheio ou arquivo longo Use a Fast Queue para prioridade; processe fora do pico; divida arquivos longos

Escolha seu plano do LALAL.AI

O Lite sai por €6,75/mês na cobrança anual, com 90 minutos de Fast Queue. O Pro custa €13,5/mês, com 250 minutos, plugin VST e processamento offline pelo Lyra.

Comece com o LALAL.AI →

Perguntas Frequentes

Posso usar os stems separados comercialmente?

O LALAL.AI concede direitos sobre o áudio processado, mas você não adquire direitos autorais sobre a música original. Para covers, remixes ou samples, ainda precisa de licenças ou permissões dos titulares.

Quantos minutos grátis eu tenho?

Contas gratuitas recebem 10 minutos de processamento com prévia. Você pode ouvir os stems separados, mas não baixá-los. Planos pagos começam em €6,75/mês (anual) com processamento ilimitado na Relaxed Queue.

Por que minha música consome mais minutos do que a duração?

Cada tipo de separação de stem conta a duração inteira da faixa em minutos. Uma música de 4 minutos com separação de voz e de bateria usa 8 minutos (4 para cada tipo).

Qual a diferença entre Fast Queue e Relaxed Queue?

A qualidade é a mesma. A Fast Queue processa na hora, mas tem limite mensal de minutos. A Relaxed Queue espera vaga no servidor (em geral 5 a 15 minutos) e é ilimitada nos planos pagos.

Dá para separar stems de arquivos de vídeo?

Sim. Envie MP4, MKV ou AVI diretamente. O LALAL.AI extrai o áudio, processa e devolve as faixas separadas.

Qual rede neural do LALAL.AI usar em 2026?

O v6 Andromeda é o padrão e cobre voz, instrumental, bateria, baixo, piano e guitarras. Troque para o v5 Perseus em sintetizador, cordas e sopros, ou quando a separação do Andromeda não soar bem. O v4 Orion continua disponível para material antigo, e o Lynx cuida do stem de voz e ruído automaticamente.

O LALAL.AI é melhor que o Demucs para separação de stems?

LALAL.AI e Demucs (Meta) seguem abordagens diferentes. O LALAL.AI oferece 11 opções de separação, apps para web, desktop e celular, e processamento que não exige instalação. O Demucs é gratuito e open source, mas precisa ser instalado localmente e só separa em 4 stems (voz, bateria, baixo e outros). Para a maioria, a praticidade e a variedade de stems do LALAL.AI pesam a favor.

Quanto tempo o LALAL.AI leva para processar uma música?

Uma faixa típica de 3 a 4 minutos leva 15 a 60 segundos na Fast Queue. Na Relaxed Queue (ilimitada nos planos pagos), costuma levar 5 a 15 minutos conforme a carga do servidor. Arquivos mais longos e formatos de maior qualidade aumentam o tempo.

Próximos passos

Agora que você sabe separar stems:

  • Experimente gêneros

    Teste estilos diferentes para entender o que a IA faz bem e onde falha

  • Monte seu fluxo

    Crie um processo estável para o seu caso de uso

  • Integre à DAW

    Importe os stems no seu software de produção

  • Teste o plugin VST

    O plano Pro inclui VST para integração direta na DAW

Leitura adicional

Este artigo foi útil?

0:00