Zum Inhalt springen

LALAL.AI Tutorial 2026: Stems trennen

Darius Z. Von Darius Z. Aktualisiert: 12 Min. Lesezeit
LALAL.AI-Tutorial mit Wellenform-Visualisierung und Oberfläche für den Stem-Trennungs-Workflow

Enthält Affiliate-Links

In diesem LALAL.AI-Tutorial lernen Sie, wie Sie Gesang, Drums, Bass, Gitarren, Piano, Synthesizer, Streicher und Bläser per KI aus jedem Song herauslösen. Voreingestellt ist die Engine v6 Andromeda, in den Settings bleiben v5 Perseus und v4 Orion wählbar. Ein Track ist in unter 60 Sekunden fertig, MP3, WAV, FLAC und Videodateien werden angenommen, und gearbeitet wird im Browser, in der Desktop-App oder am Smartphone.

Ob Karaoke-Track, Remix, Instrument-Sampling oder Üben mit isolierten Parts: Diese Anleitung führt von der einfachen Vocal-Entfernung bis zur Multi-Stem-Trennung. Wie sich das Bezahl-Tool gegen einen kostenlosen Browser-Splitter schlägt, steht in LALAL.AI vs Vocal Remover.

Wichtige Erkenntnisse

  • Der Stem-Picker listet 11 Trennoptionen: Vocal and Instrumental, Drums, Bass, Voice and Noise, Guitars, Electric Guitar, Acoustic Guitar, Piano, Synthesizer, Strings und Wind
  • Der kostenlose Starter-Tarif umfasst 10 Minuten Verarbeitung, aber nur als Vorschau ohne Download
  • Je hochwertiger die Quelldatei, desto sauberer die Trennung
  • v6 Andromeda ist voreingestellt und deckt Vocals, Drums, Bass, Piano und Gitarren ab; v5 Perseus und v4 Orion bleiben in den Settings wählbar
  • Typische Einsätze: Karaoke-Tracks, Remixe, Sampling, Üben und Content-Erstellung
LALAL.AI 4.6 Ab €6.75/Monat
LALAL.AI kostenlos testen

LALAL.AI kostenlos ausprobieren

Der kostenlose Starter-Tarif bringt 10 Minuten Verarbeitung und eine Vorschau jedes Stems. So hören Sie die Trennqualität, bevor Sie etwas bezahlen.

LALAL.AI kostenlos testen →

Was Sie brauchen

Drei Dinge: ein LALAL.AI-Konto, eine Audio- oder Videodatei und einen bezahlten Plan, falls Sie die Ergebnisse behalten wollen. Die Registrierung ist kostenlos und verlangt keine Kreditkarte. Der Starter-Tarif gibt Ihnen 10 Minuten Verarbeitung und eine Upload-Grenze von 200 MB, spielt die Ergebnisse aber nur in der Vorschau ab. Downloads beginnen bei Lite.

LALAL.AI-Konto

Kostenlos anlegen, für die Registrierung ist keine Kreditkarte nötig

Audio- oder Videodatei

MP3, WAV, FLAC, MP4: jeder Song und jede Aufnahme, die Sie trennen möchten

Bezahlter Plan (für Downloads)

Ab €6.75/Monat (jährlich), kostenlose Konten können nur die Vorschau nutzen

Der Lite-Plan kostet €8.99/Monat oder €6.75/Monat bei jährlicher Zahlung und enthält 90 Fast-Queue-Minuten pro Monat. Pro liegt bei €17.99/Monat oder €13.5/Monat im Jahresplan, mit 250 Fast-Queue-Minuten und Lyra, dem lokalen Trennmodell von LALAL.AI, das ohne Upload auf Ihrer eigenen Hardware rechnet. Wer Kundenmaterial aus Datenschutzgründen nicht in eine Cloud laden darf, arbeitet damit komplett offline.

Welche Stem-Typen kann LALAL.AI trennen?

Der Stem-Picker bietet 11 Trennoptionen, vom schlichten Vocal-Instrumental-Split über Drums, Bass und Piano bis zu Gitarren, Synthesizer, Streichern und Bläsern. Guitars fasst jede Gitarre im Track zu einem Stem zusammen, akustisch wie elektrisch. Jede Option läuft als eigener Durchlauf, vier Stems bedeuten also vier Jobs.

Stem-Typ Was extrahiert wird Am besten für
Vocal and Instrumental Gesang/Rap vom Backing-Track Karaoke, Remixe
Voice and Noise Sprache vor Hintergrundgeräuschen Podcast-Bereinigung
Drums Komplettes Schlagzeug (Kick, Snare, Hi-Hats) Sampling, Üben
Bass Bassgitarre und tiefe Frequenzen Bass-Üben, Remixe
Piano Klavier- und Keyboard-Klänge Transkription, Üben
Guitars Jede Gitarre im Track, akustisch wie elektrisch, in einem Stem Gitarre schnell entfernen, ohne den Typ zu wählen
Electric Guitar Gezielt E-Gitarre Gitarren-Üben
Acoustic Guitar Akustikgitarren-Parts Akustische Arrangements
Synthesizer Synths und elektronische Klänge EDM-Produktion
Strings Orchestrale Streicher Klassisches Sampling
Wind Blech- und Holzblasinstrumente Jazz-Arrangements
LALAL.AI Stem Splitter mit geöffnetem Stem-Menü von Vocal and Instrumental bis Wind
Der Stem-Picker der Web-App, geöffnet vor dem Upload. Guitars ist der jüngste Eintrag, und mit Voice and Noise kommt die Liste auf elf Optionen.
Info:

Zwei Dateien pro Trennung: Jede Trennung liefert das isolierte Element UND alles außer diesem Element. Bei Vocal/Instrumental erhalten Sie sowohl ein Acapella als auch eine Karaoke-Version.

Wie trennen Sie Vocals mit LALAL.AI?

Sechs Schritte: hochwertige Quelldatei vorbereiten, mit gewähltem Stem-Typ hochladen, neuronales Netz und Verarbeitung einstellen, die 30-Sekunden-Vorschau prüfen, die Datei komplett trennen, Stems herunterladen. Ein üblicher Song von drei bis vier Minuten ist in der Fast Queue nach 15 bis 60 Sekunden durch.

1

Quelldatei vorbereiten

Qualität rein, Qualität raus. Je besser die Quelle, desto sauberer die Trennung.

Beste Dateiformate (Reihenfolge):

Format Qualität Erwartetes Ergebnis
WAV/FLAC (lossless) ★★★★★ Beste Ergebnisse, sauberste Trennung
320 kbps MP3 ★★★★ Sehr gut, kaum Artefakte
256 kbps MP3 ★★★☆☆ Gut, gelegentlich Artefakte
128 kbps MP3 ★★☆☆☆ Akzeptabel, spürbare Artefakte

Wo Sie hochwertige Dateien herbekommen:

  • Kauf bei iTunes, Amazon, Bandcamp (höhere Qualität)
  • Original-CDs als WAV/FLAC gerippt
  • Producer-Releases (Stems, falls verfügbar)
  • Streaming-Rips sind meist niedriger in der Qualität
Info:

Dateigrößen-Limit: Kostenlose Konten können Dateien bis 200 MB hochladen, bezahlte bis 2 GB. Eine typische 4-Minuten-WAV-Datei liegt bei etwa 40 MB, das ist selten ein Problem.

2

Datei hochladen

Plattform wählen und Audio- oder Videodatei hochladen

Im Web:

  1. Öffnen Sie lalal.ai
  2. Suchen Sie auf der Startseite den Upload-Bereich
  3. Stem-Typ vor dem Upload wählen (wichtig!)
  4. Auf ‘Select Files’ klicken oder die Datei per Drag-and-drop ablegen
  5. Warten, bis der Upload fertig ist

In der Desktop-App:

  1. App für Mac oder Windows von LALAL.AI herunterladen
  2. App öffnen und anmelden
  3. Stem-Typ wählen
  4. Dateien in die App ziehen
  5. Upload startet automatisch

Auf dem Smartphone:

  1. Im App Store oder bei Google Play herunterladen
  2. Öffnen und anmelden
  3. Stem-Typ wählen
  4. Datei vom Gerät auswählen
  5. Upload zu den LALAL.AI-Servern

LALAL.AI nimmt die Audioformate MP3, OGG, WAV, FLAC, AIFF, AAC und M4A an, dazu die Videoformate AVI, MP4, MKV, MOV und M4V. Bezahlte Pläne verarbeiten bis zu 20 Dateien in einem Upload als Batch.

3

Einstellungen wählen

Neuronales Netz und Verarbeitungsoptionen für beste Ergebnisse einstellen

Neuronales Netz wählen

Klicken Sie auf das Zahnrad-Symbol oben rechts an der Upload-Box. Dahinter liegen die erweiterten Optionen: neuronales Netz, Stufe der Rauschunterdrückung, Enhanced Processing sowie die Reduktion von Hall und Echo auf den Vocals.

LALAL.AI Settings-Dialog mit den Netzen v6 Andromeda, v5 Perseus und v4 Orion sowie Rausch- und Verarbeitungsoptionen
Das Settings-Fenster hinter dem Zahnrad. Andromeda ist vorausgewählt, darunter stehen Perseus und Orion für die Stems, die Andromeda noch nicht abdeckt, und Rauschstufe wie Enhanced Processing sitzen im selben Dialog.
Engine Am besten für Empfehlung
v6 Andromeda (Standard) Vocals, Instrumental, Drums, Bass, Piano, Gitarren Hier anfangen; Gitarren und das neu gebaute Piano kamen im August 2026 dazu
v5 Perseus Synth, Streicher, Bläser; Alternative für jeden Stem Wechseln, wenn der Andromeda-Split daneben klingt
v4 Orion Ergebnisse im alten Stil für älteres Material Nur gelegentlich

Lynx, ein eigenes Netz für Stimmisolation, steckt hinter dem Stem Voice and Noise und hinter dem Voice Cleaner.

Stufe der Rauschunterdrückung

Wählen Sie Mild, Normal oder Aggressive, je nachdem wie viel Störgeräusch in der Quelle steckt. Aggressive holt mehr Rauschen heraus, kann bei ohnehin sauberen Aufnahmen aber die Stimme angreifen.

Enhanced Processing

Clear Cut

Reduziert Überblendung zwischen Stems. Sauberer, kann aber Details kosten. Ideal für Karaoke und Sampling.

Deep Extraction

Erfasst mehr Details, kann leichte Überblendung haben. Gut für Remixe, wenn jede Nuance zählt.

Hall- und Echo-Reduktion auf den Vocals (De-Echo)

Wenn das Original Hall hat:

  • Hall- und Echo-Reduktion (De-Echo) aktivieren für klarere Vocal-Isolation
  • Besonders sinnvoll bei Live-Aufnahmen oder stark bearbeiteten Tracks
4

Ergebnisse in der Vorschau prüfen

Jeden Stem anhören, bevor Sie Minuten für die volle Trennung ausgeben

So funktioniert die Vorschau:

  1. Nach der Verarbeitung sehen Sie Wellenformen pro Stem
  2. Auf den Play-Button jedes Stems klicken
  3. Pro Ausgabe eine 30-Sekunden-Vorschau anhören
  4. Durchscrubben und verschiedene Stellen prüfen

Worauf Sie achten sollten:

Beim isolierten Vocal:

  • Klarheit der Stimme
  • Artefakte oder ‘wässriger’ Klang
  • Durchschlagen von Instrumenten (vor allem Drums)

Beim Instrumental:

  • Fehlende Frequenzen (dünner Klang)
  • Vocal-Reste
  • Gesamtbalance im Vergleich zum Original

Wenn die Ergebnisse schwach sind:

  • Anderes neuronales Netz probieren
  • Enhanced Processing umstellen
  • Prüfen, ob die Quelldatei minderwertig ist
  • Eine andere Version des Songs testen
Erfolg:

Tipp zur Vorschau: Konzentrieren Sie sich auf Refrain und die dichtesten Passagen, dort ist die Trennung am schwierigsten. Wenn das gut klingt, passt der Rest meist auch.

5

Gesamte Datei verarbeiten

Zufrieden mit der Vorschau? Dann die komplette Spur verarbeiten

  1. Auf ‘Split in Full’ klicken
  2. Ausgabeformat wählen:
    • Same as input (empfohlen)
    • Oder: MP3, WAV, FLAC, OGG, AAC, AIFF
  3. Verarbeitung bestätigen
  4. Auf die Trennung warten (typisch 15 bis 60 Sekunden)

Warteschlangen:

  • Fast Queue: Sofortige Verarbeitung (nutzt monatliche Minuten)
  • Relaxed Queue: Wartet auf freie Serverkapazität (bei bezahlten Plänen unbegrenzt)
6

Stems herunterladen

Ihre getrennten Audiodateien holen

Sobald die Verarbeitung fertig ist:

  1. Download-Buttons erscheinen für jeden Stem
  2. Einzelne Stems herunterladen
  3. Oder ‘Download All’ für eine ZIP mit allen Spuren

Dateinamen:

  • original_name_vocals.mp3, isoliertes Vocal
  • original_name_no_vocals.mp3, Instrumental/Karaoke
Warnung:

Hinweis: Zum Download brauchen Sie einen bezahlten Plan. Kostenlose Konten können nur die Vorschau nutzen.

Erste Trennung mit LALAL.AI starten

Sie kennen jetzt die Einstellungen, auf die es ankommt. Laden Sie einen Track hoch, wählen Sie einen Stem-Typ und hören Sie, was v6 Andromeda herausholt.

Mit LALAL.AI weitermachen →

Praxisbeispiele

Vier Aufgaben führen Leute zu einem Stem-Splitter: Karaoke-Track, Remix-Material, Drum-Samples und Podcast-Bereinigung. Jede kombiniert einen Stem-Typ mit einer Enhanced-Processing-Einstellung. Clear Cut, wenn Überblendung zwischen den Stems das Ergebnis ruinieren würde; Deep Extraction, wenn jede Nuance erhalten bleiben soll.

Karaoke-Track

Song hochladen → 'Vocal and Instrumental' wählen → Clear Cut → Instrumental-Stem laden

Remix-Produktion

Upload → 'Vocal and Instrumental' → Deep Extraction + De-Echo → Vocals in die DAW importieren

Drum-Sampling

Upload → 'Drums' wählen → Deep Extraction → Im Sampler schneiden und sampeln

Podcast-Bereinigung

Audio hochladen → 'Voice and Noise' → Rauschunterdrückung auf Aggressive → sauberer Dialog

Übungsspuren erstellen

Instrument Stem wählen Ergebnis
Bass-Übung Bass Track ohne Bass, zum Mitspielen auf dem Bass
Gitarren-Übung Electric oder Acoustic Guitar Track ohne Gitarre zum Jammen
Schlagzeug-Übung Drums Track ohne Drums zum Üben
Klavier-Übung Piano Backing ohne Klavier

Wie funktioniert die Multi-Stem-Trennung?

LALAL.AI trennt pro Durchlauf ein Element. Eine vierteilige Zerlegung heißt also: dieselbe Datei viermal verarbeiten und jedes Mal einen anderen Stem-Typ wählen. Jeder Durchlauf kostet Minuten in Höhe der Dateilänge und liefert zwei Dateien, den isolierten Stem und den ganzen Rest.

Durchlauf Stem-Typ Ergebnis
1. Vocal and Instrumental Acapella + Karaoke-Track
2. Drums Isolierte Drums + Version ohne Drums
3. Bass Isolierter Bass + Version ohne Bass
4. Piano (falls vorhanden) Isoliertes Piano + Version ohne Piano
Info:

Credits: Jeder Durchlauf kostet Minuten in Höhe der Dateilänge. Ein 4-Minuten-Song mit vier verschiedenen Trennungen verbraucht 16 Minuten. Die 250 Fast-Queue-Minuten des Pro-Plans reichen grob für etwa 60 komplette Songs mit je 4-Stem-Trennung.

Wie erzielen Sie die besten Ergebnisse mit LALAL.AI?

Starten Sie mit einer verlustfreien Quelle, lassen Sie v6 Andromeda für Vocals, Drums, Bass, Piano und Gitarren stehen und wechseln Sie für Synth, Streicher und Bläser auf v5 Perseus. Clear Cut erkauft die Trennschärfe mit Detailverlust, Deep Extraction macht es umgekehrt. De-Echo lohnt sich bei allem, was Hall hat.

Sauberere Vocals

Beste Quelle + v6 Andromeda + De-Echo + Clear Cut

Volleres Instrumental

Deep Extraction + v6 Andromeda für Drums, Bass, Piano und Gitarren (v5 Perseus für Synth, Streicher, Bläser) + leichte Vocal-Reste akzeptieren + verlustfreie Quelle

Bessere Drums

Klare, knackige Drums trennen am besten. Elektronisch am saubersten; Live-Drums können stärker durchschlagen

Tipps nach Genre:

Genre Empfohlene Engine Verarbeitung Hinweis
Pop v6 Andromeda Clear Cut Insgesamt die besten Ergebnisse
Rock v6 Andromeda Deep Extraction Erhält Gitarren-Texturen
Electronic/EDM v5 Perseus (Synth) / v6 Andromeda (Vocals) Clear Cut Saubere Synth-Trennung
Hip-Hop v6 Andromeda Clear Cut + De-Echo Klarheit für Vocal-Samples
Klassik v5 Perseus (Streicher, Bläser) Deep Extraction Komplexe orchestrale Trennung
Jazz v5 Perseus (Instrumente) Deep Extraction Natürliche akustische Klänge

Häufige Probleme

Problem Ursache Lösungen
'Wässrige' oder phasige Vocals KI-Artefakte bei komplexer Trennung Anderes neuronales Netz; höherwertige Quelle; Deep Extraction testen
Dünnes Instrumental Aggressive Vocal-Entfernung hat Frequenzen mitgenommen Deep Extraction; EQ in der DAW; v5 Perseus testen
Drums im Vocal Transients sind schwer zu trennen Clear Cut; Transienten-Reduktion in der Nachbearbeitung; leichte Überblendung akzeptieren
Sehr lange Verarbeitung Hohe Serverlast oder lange Datei Fast Queue für Priorität; außerhalb der Stoßzeiten; lange Dateien teilen

Den passenden LALAL.AI-Plan wählen

Lite kostet im Jahresplan €6.75/Monat und bringt 90 Fast-Queue-Minuten. Pro liegt bei €13.5/Monat mit 250 Minuten, VST-Plugin und Lyra für die Offline-Verarbeitung.

Mit LALAL.AI loslegen →

Häufig gestellte Fragen

Darf ich getrennte Stems kommerziell nutzen?

LALAL.AI räumt Rechte am verarbeiteten Audiomaterial ein, nicht aber am Originalwerk. Für Covers, Remixe oder Samples brauchen Sie weiterhin passende Lizenzen oder Erlaubnisse der Rechteinhaber.

Wie viele kostenlose Minuten hat LALAL.AI?

Kostenlose Konten erhalten 10 Verarbeitungsminuten inklusive Vorschau. Anhören geht, Download nicht. Bezahlte Pläne starten bei €6.75/Monat (jährlich) mit unbegrenzter Relaxed-Queue-Verarbeitung.

Warum verbraucht mein Song mehr Minuten als seine Länge?

Jede Stem-Trennung zählt die volle Songlänge in Minuten. Ein 4-Minuten-Song mit Vocal- und Drum-Trennung verbraucht 8 Minuten (je 4 Minuten pro Trennungstyp).

Was ist der Unterschied zwischen Fast und Relaxed Queue?

Die Qualität ist identisch. Die Fast Queue startet sofort, hat aber monatliche Minutenlimits. Die Relaxed Queue wartet auf freie Kapazität (oft 5 bis 15 Minuten), ist bei bezahlten Plänen aber unbegrenzt.

Kann ich Stems aus Videodateien trennen?

Ja. MP4, MKV oder AVI direkt hochladen. LALAL.AI extrahiert die Tonspur, verarbeitet sie und liefert getrennte Audio-Tracks.

Welches neuronale Netz von LALAL.AI soll ich 2026 nutzen?

v6 Andromeda ist voreingestellt und deckt Vocals, Instrumental, Drums, Bass, Piano und Gitarren ab. Für Synthesizer, Streicher und Bläser wechseln Sie auf v5 Perseus, ebenso wenn ein Andromeda-Split nicht überzeugt. v4 Orion bleibt für älteres Material verfügbar, und den Stem Voice and Noise übernimmt Lynx automatisch.

Ist LALAL.AI besser als Demucs für die Stem-Trennung?

LALAL.AI und Demucs (von Meta) gehen unterschiedlich vor. LALAL.AI bietet 11 Trennoptionen, Apps für Web, Desktop und Smartphone sowie Verarbeitung ohne jedes Setup. Demucs ist kostenlos und Open Source, verlangt aber eine lokale Installation und trennt nur in vier Stems (Vocals, Drums, Bass, Other). Für die meisten Nutzer überwiegen bei LALAL.AI Komfort und Stem-Auswahl.

Wie lange braucht LALAL.AI für einen Song?

Ein typischer Song von drei bis vier Minuten braucht in der Fast Queue 15 bis 60 Sekunden. Die Relaxed Queue (bei bezahlten Plänen unbegrenzt) dauert meist 5 bis 15 Minuten, abhängig von der Auslastung. Längere Dateien und hochwertigere Formate erhöhen die Zeit.

Nächste Schritte

Wenn Sie Stems trennen können:

Mit Genres experimentieren

Verschiedene Stile testen, um Stärken und Grenzen der KI kennenzulernen

Eigenen Workflow aufbauen

Einen festen Ablauf für Ihren Anwendungsfall etablieren

Mit der DAW kombinieren

Stems in Ihre Produktionssoftware importieren und kreativ weiterarbeiten

VST-Plugin testen

Im Pro-Plan ist ein VST für die direkte DAW-Integration enthalten

War dieser Artikel hilfreich?

0:00