Saltar al contenido

Tutorial LALAL.AI: Separar Voces y Stems

Darius Z. Por Darius Z. Actualizado: 12 min de lectura
Tutorial de LALAL.AI con visualización de forma de onda e interfaz del flujo de separación de stems

Contiene enlaces de afiliados

En este tutorial de LALAL.AI aprenderás a separar voces, batería, bajo, guitarras, piano, sintetizador, cuerdas y viento de cualquier canción con IA. El motor por defecto es v6 Andromeda, y v5 Perseus y v4 Orion siguen disponibles en Settings. Cada pista tarda menos de 60 segundos, entran MP3, WAV, FLAC y archivos de vídeo, y salen pistas aisladas limpias desde el navegador, la app de escritorio o el móvil.

Tanto si quieres montar bases de karaoke como remixar, samplear instrumentos o ensayar con partes sueltas, esta guía cubre desde quitar la voz hasta la separación multistem avanzada. Si te interesa cómo aguanta la herramienta de pago frente a un separador gratuito de navegador, lee LALAL.AI vs Vocal Remover.

Puntos Clave

  • El selector de LALAL.AI lista 11 opciones de separación: voz e instrumental, batería, bajo, voz y ruido, guitarras, guitarra eléctrica, guitarra acústica, piano, sintetizador, cuerdas y viento
  • El plan gratuito da 10 minutos de procesamiento y solo vista previa, sin descargas
  • Cuanta más calidad tenga el archivo de origen, más limpias serán las separaciones
  • v6 Andromeda es el motor por defecto para voces, batería, bajo, piano y guitarras; v5 Perseus y v4 Orion siguen disponibles en Settings
  • Los usos habituales incluyen pistas de karaoke, remixes, sampling, práctica y creación de contenido
LALAL.AI ★★★★☆★ 4.6 Desde €6.75/mes
Prueba LALAL.AI Gratis

Prueba LALAL.AI gratis

El nivel Starter gratuito te da 10 minutos de procesamiento y una vista previa de cada stem, así que puedes oír la separación antes de pagar nada.

Prueba LALAL.AI gratis →

Qué necesitarás

Hacen falta tres cosas: una cuenta de LALAL.AI, un archivo de audio o vídeo y un plan de pago si quieres quedarte con el resultado. El registro es gratis y no pide tarjeta. El nivel Starter gratuito da 10 minutos de procesamiento y un tope de subida de 200 MB, pero solo te deja escuchar vistas previas. Las descargas empiezan en Lite.

  • Cuenta de LALAL.AI

    Gratis al registrarse; no hace falta tarjeta

  • Archivo de audio o vídeo

    MP3, WAV, FLAC, MP4: cualquier canción o grabación que quieras separar

  • Plan de pago (para descargas)

    Desde €6.75/mes (anual); las cuentas gratuitas solo pueden usar la vista previa

El plan Lite de LALAL.AI cuesta €8.99/mes, o €6.75/mes con facturación anual, e incluye 90 minutos de Fast Queue al mes. Pro cuesta €17.99/mes, o €13.5/mes anual, con 250 minutos de Fast Queue y procesamiento sin conexión mediante Lyra, el modelo local de LALAL.AI que separa en tu propio equipo sin subir nada. Los precios están en euros, no en dólares: dentro de la zona euro pagas la cifra que ves y, fuera de ella, tu banco aplica el cambio del día.

¿Qué tipos de stem puede separar LALAL.AI?

El selector ofrece 11 opciones de separación, desde el corte simple entre voz e instrumental hasta batería, bajo, piano, guitarras, sintetizador, cuerdas y viento. Guitars reúne todas las guitarras de la pista en un mismo stem, sean acústicas o eléctricas. Cada opción es una pasada independiente, así que un desglose de cuatro stems son cuatro trabajos.

Tipo de stem Qué extrae Ideal para
Voz e instrumental (Vocal and Instrumental) Canto o rap frente a la base Karaoke, remixes
Voz y ruido (Voice and Noise) Voz frente a sonidos de fondo Limpieza de podcasts
Batería (Drums) Kit completo (bombo, caja, charles) Sampling, práctica
Bajo (Bass) Bajo eléctrico y graves Práctica de bajo, remixes
Piano Piano y teclados Transcripción, práctica
Guitarras (Guitars) Todas las guitarras de la pista, acústicas o eléctricas, en un solo stem Quitar la guitarra rápido sin elegir tipo
Guitarra eléctrica (Electric Guitar) Guitarra eléctrica aislada Práctica de guitarra
Guitarra acústica (Acoustic Guitar) Partes de guitarra acústica Arreglos acústicos
Sintetizador (Synthesizer) Sintes y sonidos electrónicos Producción EDM
Cuerdas (Strings) Secciones de cuerdas orquestales Sampling clásico
Viento (Wind) Metales y maderas Arreglos de jazz
Caja de subida del Stem Splitter de LALAL.AI con el desplegable de stems abierto, de Vocal and Instrumental a Wind
El selector de stems de la app web, abierto antes de subir nada. Guitars es la entrada más reciente y la lista llega a once opciones contando Voice and Noise.
Información:

Dos archivos por separación: Cada separación genera el elemento aislado Y todo lo demás sin ese elemento. La separación de voz e instrumental te da a la vez un acapella y una base tipo karaoke.

¿Cómo se separan las voces con LALAL.AI?

Son seis pasos: prepara un archivo de origen de calidad, súbelo con el tipo de stem ya elegido, ajusta la red neuronal y el procesamiento, escucha la vista previa de 30 segundos, divide el archivo completo y descarga los stems. Una canción de tres o cuatro minutos termina en 15 a 60 segundos en la Fast Queue.

1

Prepara el archivo de origen

Calidad de entrada, calidad de salida. Mejor fuente, separación más limpia.

Mejores formatos (ordenados):

Formato Calidad Resultado esperado
WAV/FLAC (sin pérdida) ★★★★★ Lo mejor: separación más limpia
MP3 320 kbps ★★★★☆ Muy bueno: pocos artefactos
MP3 256 kbps ★★★☆☆ Bueno: pueden aparecer artefactos
MP3 128 kbps ★★☆☆☆ Aceptable: artefactos perceptibles

Dónde conseguir archivos de calidad:

  • Compra en iTunes, Amazon o Bandcamp (mejor calidad)
  • CDs originales pasados a WAV/FLAC
  • Lanzamientos del productor (stems si existen)
  • Las copias desde streaming suelen ser de menor calidad
Información:

Límite de tamaño: Las cuentas gratuitas pueden subir hasta 200 MB; las de pago, hasta 2 GB. Un WAV de unos 4 minutos ronda los 40 MB, así que casi nunca es un problema.

2

Sube tu archivo

Elige plataforma y sube tu audio o vídeo

En la web:

  1. Entra en lalal.ai
  2. Localiza la zona de subida en la página principal
  3. Elige el tipo de stem antes de subir (¡importante!)
  4. Pulsa Seleccionar archivos (Select Files) o arrastra el archivo
  5. Espera a que termine la subida

En la app de escritorio:

  1. Descarga la app para Mac o Windows desde LALAL.AI
  2. Ábrela e inicia sesión
  3. Selecciona el tipo de stem
  4. Arrastra los archivos a la app
  5. La subida empieza sola

En móvil:

  1. Descárgala en App Store o Google Play
  2. Ábrela e inicia sesión
  3. Elige el tipo de stem
  4. Selecciona el archivo en el dispositivo
  5. Súbelo a los servidores de LALAL.AI

LALAL.AI acepta audio en MP3, OGG, WAV, FLAC, AIFF, AAC y M4A, y vídeo en AVI, MP4, MKV, MOV y M4V. Los planes de pago procesan por lotes hasta 20 archivos en una misma subida.

3

Ajusta la configuración

Red neuronal y opciones de procesamiento para el mejor resultado

Elección de red neuronal

Pulsa el icono del engranaje, arriba a la derecha de la caja de subida, para abrir las opciones avanzadas: red neuronal, nivel de cancelación de ruido, procesamiento mejorado y reducción de reverb y eco en la voz.

Diálogo Settings de LALAL.AI con las redes v6 Andromeda, v5 Perseus y v4 Orion y las opciones de ruido y procesamiento
El panel Settings que hay detrás del engranaje. Andromeda viene ya marcado, Perseus y Orion quedan debajo para los stems que todavía no cubre, y en el mismo sitio están el nivel de ruido y los interruptores de Enhanced Processing.
Motor Ideal para Recomendación
v6 Andromeda (por defecto) Voces, instrumental, batería, bajo, piano y guitarras Empieza aquí; las guitarras y el piano rehecho llegaron en agosto de 2026
v5 Perseus Sintetizador, cuerdas y viento; alternativa para cualquier stem Cámbiate aquí si la separación de Andromeda no suena bien
v4 Orion Resultados clásicos para material antiguo Uso puntual

Lynx, una red de aislamiento de voz aparte, es la que mueve el stem Voice and Noise y la herramienta Voice Cleaner.

Nivel de cancelación de ruido

Elige Mild, Normal o Aggressive según el ruido de fondo que traiga el original. Aggressive quita más ruido, pero puede afectar a la voz en grabaciones que ya están limpias.

Procesamiento mejorado (Enhanced Processing)

  • Clear Cut

    Reduce el bleed entre stems. Más limpio pero puede perder detalle. Ideal para karaoke y sampling.

  • Deep Extraction

    Capta más matices pero puede haber algo de bleed. Mejor para remixes cuando quieres cada detalle.

Reducción de reverb y eco en la voz (De-Echo)

Si el original lleva reverb:

  • Activa la reducción de reverb y eco (De-Echo) para un aislamiento vocal más limpio
  • Muy útil en directos o mezclas muy cargadas
4

Escucha la vista previa

Escucha cada stem antes de gastar minutos en la separación completa

Cómo previsualizar:

  1. Tras procesar la subida verás las formas de onda de cada stem
  2. Pulsa reproducir en cada stem
  3. Escucha 30 segundos de vista previa de cada salida
  4. Desplázate para oír distintas partes

En qué fijarte:

En la voz aislada:

  • Claridad de la voz
  • Artefactos o sonido ‘acuoso’
  • Bleed de instrumentos (sobre todo batería)

En el instrumental:

  • Frecuencias que faltan (sonido fino)
  • Restos de voz
  • Equilibrio general frente al original

Si el resultado es flojo:

  • Prueba otra red neuronal
  • Cambia el modo de procesamiento mejorado
  • Comprueba si el archivo de origen es de baja calidad
  • Prueba otra versión de la canción
Éxito:

Consejo de vista previa: Céntrate en el estribillo y en las partes más densas. Ahí la separación cuesta más. Si ahí suena bien, lo demás suele ir bien.

5

Procesa el archivo completo

¿Te convence la vista previa? Toca procesar la pista entera

  1. Pulsa Dividir por completo (Split in Full en inglés)
  2. Elige el formato de salida:
    • Igual que la entrada (recomendado)
    • O: MP3, WAV, FLAC, OGG, AAC, AIFF
  3. Confirma el procesamiento
  4. Espera la separación (normalmente de 15 a 60 segundos)

Tipos de cola:

  • Fast Queue: procesamiento inmediato (usa minutos del mes)
  • Relaxed Queue: espera a que haya capacidad (ilimitada en planes de pago)
6

Descarga tus stems

Obtén los archivos de audio separados

Cuando termine el procesamiento:

  1. Aparecen botones de descarga para cada stem
  2. Descarga stems sueltos
  3. O usa Descargar todo (Download All) para un zip

Nombres de archivo:

  • original_name_vocals.mp3: voces aisladas
  • original_name_no_vocals.mp3: instrumental o karaoke
Advertencia:

Nota: La descarga requiere plan de pago. Las cuentas gratuitas solo pueden usar la vista previa.

Haz tu primera separación con LALAL.AI

Ya sabes qué ajustes importan. Sube una pista, elige un tipo de stem y escucha lo que saca v6 Andromeda.

Continúa con LALAL.AI →

Ejemplos prácticos

Los cuatro encargos que llegan a un separador de stems son la base de karaoke, el material para un remix, los samples de batería y la limpieza de podcast. Cada uno combina un tipo de stem con un ajuste de Enhanced Processing. Clear Cut cuando el bleed entre stems es justo lo que arruinaría el resultado; Deep Extraction cuando quieres conservar cada matiz.

  • Pista de karaoke

    Sube la canción → elige Voz e instrumental → Clear Cut → descarga el stem instrumental

  • Remix

    Sube → Voz e instrumental → Deep Extraction + De-Echo → importa las voces a tu DAW

  • Sampling de batería

    Sube → Batería → Deep Extraction → trocea y samplea en tu sampler

  • Limpieza de podcast

    Sube el audio → Voz y ruido → cancelación de ruido agresiva → diálogo limpio

Pistas para practicar

Instrumento Stem a elegir Qué obtienes
Practicar bajo Bajo Pista sin bajo para tocar encima
Practicar guitarra Guitarra eléctrica o acústica Base sin guitarra para improvisar
Practicar batería Batería Pista sin batería para ensayar
Practicar piano Piano Base sin piano

¿Cómo funciona la separación multistem?

LALAL.AI separa un elemento por pasada, así que un desglose en cuatro partes significa pasar el mismo archivo cuatro veces cambiando el tipo de stem en cada ronda. Cada pasada consume minutos equivalentes a la duración del archivo y devuelve dos archivos: el stem aislado y todo lo demás.

Pasada Tipo de stem Qué obtienes
1.ª Voz e instrumental Acapella + base karaoke
2.ª Batería Batería aislada + versión sin batería
3.ª Bajo Bajo aislado + versión sin bajo
4.ª Piano (si está presente) Piano aislado + versión sin piano
Información:

Consumo de minutos: Cada pasada consume minutos iguales a la duración del archivo. Una canción de 4 minutos en 4 tipos son 16 minutos en total. Los 250 minutos de Fast Queue del plan Pro dan para unas 60 canciones completas con separación en 4 stems cada una.

¿Cómo obtener los mejores resultados con LALAL.AI?

Parte de un origen sin pérdidas, deja v6 Andromeda puesto para voces, batería, bajo, piano y guitarras, y cámbiate a v5 Perseus para sintetizador, cuerdas y viento. Clear Cut te compra separación a costa de detalle y Deep Extraction hace lo contrario. En cualquier grabación con reverb, merece la pena activar el De-Echo.

  • Voces más limpias

    Máxima calidad de origen + v6 Andromeda + De-Echo + modo Clear Cut

  • Instrumentales más completos

    Modo Deep Extraction + v6 Andromeda para batería, bajo, piano y guitarras (v5 Perseus para sinte, cuerdas y viento) + aceptar leves restos de voz + origen sin pérdidas

  • Mejor batería

    La batería clara y contundente se separa mejor. La electrónica sale muy limpia; la en vivo puede llevar bleed

Consejos por género:

Género Motor recomendado Modo de procesamiento Notas
Pop v6 Andromeda Clear Cut Los mejores resultados generales
Rock v6 Andromeda Deep Extraction Conserva texturas de guitarra
Electrónica / EDM v5 Perseus (sinte) / v6 Andromeda (voces) Clear Cut Separación limpia de sintes
Hip-hop v6 Andromeda Clear Cut + De-Echo Claridad para samples vocales
Clásica v5 Perseus (cuerdas, viento) Deep Extraction Separación orquestal compleja
Jazz v5 Perseus (instrumentos) Deep Extraction Sonidos acústicos naturales

Solución de problemas habituales

Problema Causa Soluciones
Voz 'acuosa' o con fase Artefactos de la IA en separaciones difíciles Prueba otra red neuronal; sube la calidad del origen; prueba Deep Extraction
Instrumental fino La eliminación agresiva de voz se llevó frecuencias Usa Deep Extraction; aplica EQ en el DAW; prueba v5 Perseus
Batería que entra en la voz Los transitorios cuestan de separar Usa Clear Cut; reduce transitorios en la posproducción; acepta un poco de bleed
Tarda mucho en procesar Mucha carga en el servidor o archivo largo Usa la Fast Queue para tener prioridad; procesa fuera de horas punta; divide los archivos largos

Elige tu plan de LALAL.AI

Lite sale a €6.75/mes con facturación anual y 90 minutos de Fast Queue. Pro cuesta €13.5/mes con 250 minutos, el plugin VST y el procesamiento sin conexión con Lyra.

Empieza con LALAL.AI →

Preguntas Frecuentes

¿Puedo usar los stems separados con fines comerciales?

LALAL.AI te otorga derechos sobre el audio procesado, pero no adquieres el copyright de la música original. Para covers, remixes o samples sigues necesitando licencias o permisos de los titulares.

¿Cuántos minutos gratis tengo?

Las cuentas gratuitas tienen 10 minutos de procesamiento con vista previa. Puedes escuchar los stems separados pero no descargarlos. Los planes de pago empiezan en €6.75/mes (anual) con Relaxed Queue ilimitada.

¿Por qué mi canción gasta más minutos que su duración?

Cada tipo de separación de stem cuenta la duración completa de la canción. Una canción de 4 minutos con separación de voces y de batería son 8 minutos (4 + 4).

¿Qué diferencia hay entre la Fast Queue y la Relaxed Queue?

La calidad es la misma. La Fast Queue procesa al momento pero tiene límite mensual de minutos. La Relaxed Queue espera hueco en el servidor (suele ser de 5 a 15 minutos) y es ilimitada en planes de pago.

¿Puedo separar stems de archivos de vídeo?

Sí. Sube MP4, MKV o AVI directamente. LALAL.AI extrae el audio, lo procesa y devuelve pistas de audio separadas.

¿Qué red neuronal de LALAL.AI conviene usar en 2026?

v6 Andromeda es la opción por defecto y cubre voces, instrumental, batería, bajo, piano y guitarras. Cámbiate a v5 Perseus para sintetizador, cuerdas y viento, o cuando una separación de Andromeda no acabe de sonar bien. v4 Orion sigue disponible para material antiguo, y Lynx se encarga del stem Voice and Noise de forma automática.

¿LALAL.AI es mejor que Demucs para separar stems?

LALAL.AI y Demucs (de Meta) siguen enfoques distintos. LALAL.AI ofrece 11 opciones de separación, apps para web, escritorio y móvil, y un procesamiento que no exige instalar nada. Demucs es gratis y de código abierto pero requiere instalación local y solo separa en 4 stems (voces, batería, bajo y otros). Para la mayoría, la comodidad de LALAL.AI y su variedad de stems lo hacen más práctico.

¿Cuánto tarda LALAL.AI en procesar una canción?

Una canción típica de 3 a 4 minutos suele tardar de 15 a 60 segundos en la Fast Queue. La Relaxed Queue (ilimitada en planes de pago) suele tardar de 5 a 15 minutos según la carga. Los archivos largos y los formatos de mayor calidad aumentan el tiempo.

Próximos pasos

Ya puedes separar stems:

  • Prueba distintos géneros

    Explora estilos para ver qué puede y qué no puede la IA

  • Monta tu flujo

    Define un proceso fiable para tu caso de uso

  • Llévalo al DAW

    Importa stems a tu software de producción para crear

  • Prueba el plugin VST

    El plan Pro incluye VST para integrarlo en el DAW

Más lectura

¿Te resultó útil este artículo?

0:00