Reseña LALAL.AI 2026: Separar Voces
LALAL.AI separa voces, batería, bajo y 7 stems más con IA. Vista previa gratuita de 10 min; planes desde 6,75 €/mes. Pros, contras y rendimiento real.
Leer Artículo →
En este tutorial de LALAL.AI aprenderás a separar voces, batería, bajo, guitarras, piano, sintetizador, cuerdas y viento de cualquier canción con IA. El motor por defecto es v6 Andromeda, y v5 Perseus y v4 Orion siguen disponibles en Settings. Cada pista tarda menos de 60 segundos, entran MP3, WAV, FLAC y archivos de vídeo, y salen pistas aisladas limpias desde el navegador, la app de escritorio o el móvil.
Tanto si quieres montar bases de karaoke como remixar, samplear instrumentos o ensayar con partes sueltas, esta guía cubre desde quitar la voz hasta la separación multistem avanzada. Si te interesa cómo aguanta la herramienta de pago frente a un separador gratuito de navegador, lee LALAL.AI vs Vocal Remover.
El nivel Starter gratuito te da 10 minutos de procesamiento y una vista previa de cada stem, así que puedes oír la separación antes de pagar nada.
Prueba LALAL.AI gratis →Hacen falta tres cosas: una cuenta de LALAL.AI, un archivo de audio o vídeo y un plan de pago si quieres quedarte con el resultado. El registro es gratis y no pide tarjeta. El nivel Starter gratuito da 10 minutos de procesamiento y un tope de subida de 200 MB, pero solo te deja escuchar vistas previas. Las descargas empiezan en Lite.
Gratis al registrarse; no hace falta tarjeta
MP3, WAV, FLAC, MP4: cualquier canción o grabación que quieras separar
Desde €6.75/mes (anual); las cuentas gratuitas solo pueden usar la vista previa
El plan Lite de LALAL.AI cuesta €8.99/mes, o €6.75/mes con facturación anual, e incluye 90 minutos de Fast Queue al mes. Pro cuesta €17.99/mes, o €13.5/mes anual, con 250 minutos de Fast Queue y procesamiento sin conexión mediante Lyra, el modelo local de LALAL.AI que separa en tu propio equipo sin subir nada. Los precios están en euros, no en dólares: dentro de la zona euro pagas la cifra que ves y, fuera de ella, tu banco aplica el cambio del día.
El selector ofrece 11 opciones de separación, desde el corte simple entre voz e instrumental hasta batería, bajo, piano, guitarras, sintetizador, cuerdas y viento. Guitars reúne todas las guitarras de la pista en un mismo stem, sean acústicas o eléctricas. Cada opción es una pasada independiente, así que un desglose de cuatro stems son cuatro trabajos.
| Tipo de stem | Qué extrae | Ideal para |
|---|---|---|
| Voz e instrumental (Vocal and Instrumental) | Canto o rap frente a la base | Karaoke, remixes |
| Voz y ruido (Voice and Noise) | Voz frente a sonidos de fondo | Limpieza de podcasts |
| Batería (Drums) | Kit completo (bombo, caja, charles) | Sampling, práctica |
| Bajo (Bass) | Bajo eléctrico y graves | Práctica de bajo, remixes |
| Piano | Piano y teclados | Transcripción, práctica |
| Guitarras (Guitars) | Todas las guitarras de la pista, acústicas o eléctricas, en un solo stem | Quitar la guitarra rápido sin elegir tipo |
| Guitarra eléctrica (Electric Guitar) | Guitarra eléctrica aislada | Práctica de guitarra |
| Guitarra acústica (Acoustic Guitar) | Partes de guitarra acústica | Arreglos acústicos |
| Sintetizador (Synthesizer) | Sintes y sonidos electrónicos | Producción EDM |
| Cuerdas (Strings) | Secciones de cuerdas orquestales | Sampling clásico |
| Viento (Wind) | Metales y maderas | Arreglos de jazz |

Dos archivos por separación: Cada separación genera el elemento aislado Y todo lo demás sin ese elemento. La separación de voz e instrumental te da a la vez un acapella y una base tipo karaoke.
Son seis pasos: prepara un archivo de origen de calidad, súbelo con el tipo de stem ya elegido, ajusta la red neuronal y el procesamiento, escucha la vista previa de 30 segundos, divide el archivo completo y descarga los stems. Una canción de tres o cuatro minutos termina en 15 a 60 segundos en la Fast Queue.
Calidad de entrada, calidad de salida. Mejor fuente, separación más limpia.
| Formato | Calidad | Resultado esperado |
|---|---|---|
| WAV/FLAC (sin pérdida) | ★★★★★ | Lo mejor: separación más limpia |
| MP3 320 kbps | ★★★★☆ | Muy bueno: pocos artefactos |
| MP3 256 kbps | ★★★☆☆ | Bueno: pueden aparecer artefactos |
| MP3 128 kbps | ★★☆☆☆ | Aceptable: artefactos perceptibles |
Límite de tamaño: Las cuentas gratuitas pueden subir hasta 200 MB; las de pago, hasta 2 GB. Un WAV de unos 4 minutos ronda los 40 MB, así que casi nunca es un problema.
Elige plataforma y sube tu audio o vídeo
LALAL.AI acepta audio en MP3, OGG, WAV, FLAC, AIFF, AAC y M4A, y vídeo en AVI, MP4, MKV, MOV y M4V. Los planes de pago procesan por lotes hasta 20 archivos en una misma subida.
Red neuronal y opciones de procesamiento para el mejor resultado
Pulsa el icono del engranaje, arriba a la derecha de la caja de subida, para abrir las opciones avanzadas: red neuronal, nivel de cancelación de ruido, procesamiento mejorado y reducción de reverb y eco en la voz.

| Motor | Ideal para | Recomendación |
|---|---|---|
| v6 Andromeda (por defecto) | Voces, instrumental, batería, bajo, piano y guitarras | Empieza aquí; las guitarras y el piano rehecho llegaron en agosto de 2026 |
| v5 Perseus | Sintetizador, cuerdas y viento; alternativa para cualquier stem | Cámbiate aquí si la separación de Andromeda no suena bien |
| v4 Orion | Resultados clásicos para material antiguo | Uso puntual |
Lynx, una red de aislamiento de voz aparte, es la que mueve el stem Voice and Noise y la herramienta Voice Cleaner.
Elige Mild, Normal o Aggressive según el ruido de fondo que traiga el original. Aggressive quita más ruido, pero puede afectar a la voz en grabaciones que ya están limpias.
Reduce el bleed entre stems. Más limpio pero puede perder detalle. Ideal para karaoke y sampling.
Capta más matices pero puede haber algo de bleed. Mejor para remixes cuando quieres cada detalle.
Si el original lleva reverb:
Escucha cada stem antes de gastar minutos en la separación completa
En la voz aislada:
En el instrumental:
Si el resultado es flojo:
Consejo de vista previa: Céntrate en el estribillo y en las partes más densas. Ahí la separación cuesta más. Si ahí suena bien, lo demás suele ir bien.
¿Te convence la vista previa? Toca procesar la pista entera
Obtén los archivos de audio separados
Cuando termine el procesamiento:
original_name_vocals.mp3: voces aisladasoriginal_name_no_vocals.mp3: instrumental o karaokeNota: La descarga requiere plan de pago. Las cuentas gratuitas solo pueden usar la vista previa.
Ya sabes qué ajustes importan. Sube una pista, elige un tipo de stem y escucha lo que saca v6 Andromeda.
Continúa con LALAL.AI →Los cuatro encargos que llegan a un separador de stems son la base de karaoke, el material para un remix, los samples de batería y la limpieza de podcast. Cada uno combina un tipo de stem con un ajuste de Enhanced Processing. Clear Cut cuando el bleed entre stems es justo lo que arruinaría el resultado; Deep Extraction cuando quieres conservar cada matiz.
Sube la canción → elige Voz e instrumental → Clear Cut → descarga el stem instrumental
Sube → Voz e instrumental → Deep Extraction + De-Echo → importa las voces a tu DAW
Sube → Batería → Deep Extraction → trocea y samplea en tu sampler
Sube el audio → Voz y ruido → cancelación de ruido agresiva → diálogo limpio
| Instrumento | Stem a elegir | Qué obtienes |
|---|---|---|
| Practicar bajo | Bajo | Pista sin bajo para tocar encima |
| Practicar guitarra | Guitarra eléctrica o acústica | Base sin guitarra para improvisar |
| Practicar batería | Batería | Pista sin batería para ensayar |
| Practicar piano | Piano | Base sin piano |
LALAL.AI separa un elemento por pasada, así que un desglose en cuatro partes significa pasar el mismo archivo cuatro veces cambiando el tipo de stem en cada ronda. Cada pasada consume minutos equivalentes a la duración del archivo y devuelve dos archivos: el stem aislado y todo lo demás.
| Pasada | Tipo de stem | Qué obtienes |
|---|---|---|
| 1.ª | Voz e instrumental | Acapella + base karaoke |
| 2.ª | Batería | Batería aislada + versión sin batería |
| 3.ª | Bajo | Bajo aislado + versión sin bajo |
| 4.ª | Piano (si está presente) | Piano aislado + versión sin piano |
Consumo de minutos: Cada pasada consume minutos iguales a la duración del archivo. Una canción de 4 minutos en 4 tipos son 16 minutos en total. Los 250 minutos de Fast Queue del plan Pro dan para unas 60 canciones completas con separación en 4 stems cada una.
Parte de un origen sin pérdidas, deja v6 Andromeda puesto para voces, batería, bajo, piano y guitarras, y cámbiate a v5 Perseus para sintetizador, cuerdas y viento. Clear Cut te compra separación a costa de detalle y Deep Extraction hace lo contrario. En cualquier grabación con reverb, merece la pena activar el De-Echo.
Máxima calidad de origen + v6 Andromeda + De-Echo + modo Clear Cut
Modo Deep Extraction + v6 Andromeda para batería, bajo, piano y guitarras (v5 Perseus para sinte, cuerdas y viento) + aceptar leves restos de voz + origen sin pérdidas
La batería clara y contundente se separa mejor. La electrónica sale muy limpia; la en vivo puede llevar bleed
| Género | Motor recomendado | Modo de procesamiento | Notas |
|---|---|---|---|
| Pop | v6 Andromeda | Clear Cut | Los mejores resultados generales |
| Rock | v6 Andromeda | Deep Extraction | Conserva texturas de guitarra |
| Electrónica / EDM | v5 Perseus (sinte) / v6 Andromeda (voces) | Clear Cut | Separación limpia de sintes |
| Hip-hop | v6 Andromeda | Clear Cut + De-Echo | Claridad para samples vocales |
| Clásica | v5 Perseus (cuerdas, viento) | Deep Extraction | Separación orquestal compleja |
| Jazz | v5 Perseus (instrumentos) | Deep Extraction | Sonidos acústicos naturales |
| Problema | Causa | Soluciones |
|---|---|---|
| Voz 'acuosa' o con fase | Artefactos de la IA en separaciones difíciles | Prueba otra red neuronal; sube la calidad del origen; prueba Deep Extraction |
| Instrumental fino | La eliminación agresiva de voz se llevó frecuencias | Usa Deep Extraction; aplica EQ en el DAW; prueba v5 Perseus |
| Batería que entra en la voz | Los transitorios cuestan de separar | Usa Clear Cut; reduce transitorios en la posproducción; acepta un poco de bleed |
| Tarda mucho en procesar | Mucha carga en el servidor o archivo largo | Usa la Fast Queue para tener prioridad; procesa fuera de horas punta; divide los archivos largos |
Lite sale a €6.75/mes con facturación anual y 90 minutos de Fast Queue. Pro cuesta €13.5/mes con 250 minutos, el plugin VST y el procesamiento sin conexión con Lyra.
Empieza con LALAL.AI →LALAL.AI te otorga derechos sobre el audio procesado, pero no adquieres el copyright de la música original. Para covers, remixes o samples sigues necesitando licencias o permisos de los titulares.
Las cuentas gratuitas tienen 10 minutos de procesamiento con vista previa. Puedes escuchar los stems separados pero no descargarlos. Los planes de pago empiezan en €6.75/mes (anual) con Relaxed Queue ilimitada.
Cada tipo de separación de stem cuenta la duración completa de la canción. Una canción de 4 minutos con separación de voces y de batería son 8 minutos (4 + 4).
La calidad es la misma. La Fast Queue procesa al momento pero tiene límite mensual de minutos. La Relaxed Queue espera hueco en el servidor (suele ser de 5 a 15 minutos) y es ilimitada en planes de pago.
Sí. Sube MP4, MKV o AVI directamente. LALAL.AI extrae el audio, lo procesa y devuelve pistas de audio separadas.
v6 Andromeda es la opción por defecto y cubre voces, instrumental, batería, bajo, piano y guitarras. Cámbiate a v5 Perseus para sintetizador, cuerdas y viento, o cuando una separación de Andromeda no acabe de sonar bien. v4 Orion sigue disponible para material antiguo, y Lynx se encarga del stem Voice and Noise de forma automática.
LALAL.AI y Demucs (de Meta) siguen enfoques distintos. LALAL.AI ofrece 11 opciones de separación, apps para web, escritorio y móvil, y un procesamiento que no exige instalar nada. Demucs es gratis y de código abierto pero requiere instalación local y solo separa en 4 stems (voces, batería, bajo y otros). Para la mayoría, la comodidad de LALAL.AI y su variedad de stems lo hacen más práctico.
Una canción típica de 3 a 4 minutos suele tardar de 15 a 60 segundos en la Fast Queue. La Relaxed Queue (ilimitada en planes de pago) suele tardar de 5 a 15 minutos según la carga. Los archivos largos y los formatos de mayor calidad aumentan el tiempo.
Ya puedes separar stems:
Explora estilos para ver qué puede y qué no puede la IA
Define un proceso fiable para tu caso de uso
Importa stems a tu software de producción para crear
El plan Pro incluye VST para integrarlo en el DAW
Introducción académica a la separación de fuentes - Cómo funciona la separación de stems con IA
iZotope: guía sobre separación de audio - Visión del sector sobre el aislamiento de stems