Gesang aus einem Lied entfernen: 5 einfache Methoden (2026)
2026/09/17

Gesang aus einem Lied entfernen: 5 einfache Methoden (2026)

Stimme aus einem Lied entfernen – mit KI-Vocal-Remover, Audacity, UVR, DAW oder Smartphone. Anleitungen, Lösungen bei Problemen und rechtliche Grundlagen.

Vor ein paar Jahren hieß „Gesang aus einem Lied entfernen“ noch: die Phase eines Kanals umkehren und auf das Beste hoffen.

Meist kam dabei ein hohler Mono-Brei heraus – die Stimme hallte im Hintergrund noch nach, und die Basslinie war verschwunden.

Dieser Trick hat ausgedient. Heutige KI-Modelle zur Quellentrennung wurden mit Tausenden von Mehrspuraufnahmen trainiert. Sie lösen eine Stimme so sauber aus einem fertigen Mix, dass es für Karaoke, Übungstracks, Remixe und sogar grobe Demos reicht.

Der Haken: Inzwischen gibt es ein Dutzend Wege dorthin, und sie sind nicht alle gleich gut.

In diesem Leitfaden lernen Sie fünf Methoden kennen, die wirklich funktionieren – vom Browser-Tool, das in einer Minute fertig ist, bis zur kostenlosen Desktop-Software. Außerdem erfahren Sie, was veröffentlichte Benchmarks über die Qualität sagen, wie Sie die häufigsten Probleme beheben und wo die rechtlichen Grenzen verlaufen.

Das erfahren Sie hier:

  • Den schnellsten Weg, Gesang zu entfernen – ganz ohne Installation
  • Wie es kostenlos in Audacity klappt, inklusive des KI-Plug-ins, das die meisten Anleitungen übersehen
  • Wann sich eine Desktop-App wie Ultimate Vocal Remover die Einrichtung lohnt
  • Wie Sie den Stem-Splitter nutzen, der in Logic Pro, Ableton Live und FL Studio bereits eingebaut ist
  • Wie Sie Geistergesang, Hall-Fahnen und „wässrig“ klingende Instrumentals beheben
  • Was Sie mit dem Ergebnis rechtlich dürfen – und was nicht

Kurze Antwort: Um den Gesang aus einem Lied zu entfernen, laden Sie die Audiodatei in einen KI-Vocal Remover hoch, lassen das Modell den Song in zwei Stems trennen und laden dann das Instrumental herunter. Ein dreiminütiger Song dauert etwa eine Minute. Als kostenlose Offline-Option eignen sich Audacity mit Intels Plug-in OpenVINO Music Separation oder die Desktop-App Ultimate Vocal Remover.


Welche Methode ist die richtige für Sie?

Jede der folgenden Methoden liefert ein Instrumental. Sie unterscheiden sich in Tempo, Kosten, Einrichtungsaufwand und darin, wie viel Kontrolle Sie haben.

Hier die Kurzfassung, bevor es Schritt für Schritt losgeht.

Die 5 Methoden im Überblick

MethodeKostenEinrichtungTempo (3-Minuten-Song)QualitätAm besten für
1. Online-KI-Vocal-RemoverTäglich ein Song kostenlos, danach kostenpflichtigKeine~1 MinuteHochDie meisten Nutzer, Smartphones, einmalige Aufgaben
2. Audacity + KI-Plug-inKostenlosMittel1–3 MinutenHochBestehende Audacity-Nutzer, Offline-Arbeit
3. Ultimate Vocal RemoverKostenlosMittel bis hochSekunden (GPU) bis Minuten (CPU)Sehr hoch, fein einstellbarFortgeschrittene, Stapelverarbeitung
4. Stem-Splitter der DAWIn der DAW enthaltenGering, wenn Sie sie besitzen~1 MinuteHochProduzenten, die schon mit Logic, Ableton oder FL arbeiten
5. Smartphone-AppsFreemiumApp-Installation~1 MinuteHochMusiker, die unterwegs üben

Schnell entscheiden

Wenn Sie nicht wissen, wo Sie anfangen sollen, folgen Sie dem Schema unten. Die meisten sind schon nach der ersten Frage fertig.

Entscheidungsschema zur Wahl der Methode zum Entfernen von Gesang: Online-KI-Tool, Stem-Splitter der DAW, Ultimate Vocal Remover oder Audacity

💡 Profi-Tipp: Bevor Sie irgendetwas trennen, suchen Sie nach einem offiziellen Instrumental. Viele Alben enthalten eines, und Karaoke-Versionen bekannter Songs sind vielfach lizenziert erhältlich. Ein offizielles Instrumental schlägt ein extrahiertes immer.


Vorab: So funktioniert das Entfernen von Gesang wirklich

Für ein Ergebnis brauchen Sie die Theorie nicht. Sie bewahrt Sie aber vor den häufigsten Fehlern – vor allem dann, wenn ein Ergebnis falsch klingt und Sie wissen wollen, warum.

Was bedeutet „Gesang entfernen“?

Gesang entfernen heißt, einen fertigen Song in einzelne Ebenen – sogenannte Stems – aufzuteilen und alles außer der Stimme zu behalten.

Die meisten Tools liefern zwei Stems:

  • Gesang (Acapella): Leadstimme und Harmonien ohne Instrumente
  • Instrumental (Karaoke-Spur): Schlagzeug, Bass, Gitarren, Keys und alles Übrige

Manche Tools gehen weiter und trennen vier oder sechs Stems: Gesang, Schlagzeug, Bass, Klavier, Gitarre und „Sonstiges“. Wenn es nur ums Entfernen des Gesangs geht, sind zwei Stems meist sauberer, weil das Modell nur eine einzige Entscheidung treffen muss.

Methode A: Phasenauslöschung (der alte Trick)

Die Phasenauslöschung beruht auf einer Gewohnheit beim Mischen: Der Leadgesang liegt fast immer genau in der Mitte des Panoramas und ist daher im linken und rechten Kanal identisch.

So funktioniert es

  1. Den Stereo-Song in linken und rechten Kanal aufteilen.
  2. Die Wellenform eines Kanals umkehren (invertieren).
  3. Beide Kanäle wieder zusammenmischen.

Alles, was auf beiden Seiten identisch ist, löscht sich zu Stille aus. Der Gesang verschwindet – und mit ihm alles andere, was in der Mitte liegt.

Warum das Ergebnis meist enttäuscht

Genau dieser letzte Punkt ist das Problem. Bass, Kickdrum und Snare werden ebenfalls in die Mitte gemischt, also verschwinden auch sie.

Gleichzeitig überleben die Teile des Gesangs, die nicht auf beiden Seiten identisch sind:

  • Stereo-Hall und -Delay auf der Stimme
  • Backgroundgesang und Doppelungen, die links und rechts im Panorama liegen
  • Jede Gesangsspur, die leicht außermittig gemischt wurde

Und ist die Datei mono, sind beide Kanäle ohnehin identisch. Löscht man sie gegeneinander aus, verschwindet der komplette Song.

Methode B: KI-Quellentrennung (der moderne Weg)

Der KI-Trennung ist es egal, wo die Stimme im Panorama liegt. Sie orientiert sich daran, wie die Stimme klingt.

So funktioniert es

Ein Song lässt sich als Spektrogramm darstellen: eine Karte, die zeigt, welche Frequenzen zu jedem Zeitpunkt erklingen.

Ein Trennungsmodell hat Tausende von Songs analysiert, bei denen Gesangs- und Instrumentalspur getrennt vorlagen. Dabei hat es gelernt, wie eine menschliche Stimme auf dieser Karte aussieht.

Bei einem neuen Song sagt es eine „Maske“ der Bereiche voraus, die zur Stimme gehören. Mit der Maske erzeugt es das Acapella, mit ihrer Umkehrung das Instrumental.

Vergleich von Phasenauslöschung und KI-Quellentrennung beim Entfernen von Gesang

Phasenauslöschung und KI im Vergleich

PhasenauslöschungKI-Quellentrennung
Funktioniert mit Mono-DateienNeinJa
Bass und Kickdrum bleiben erhaltenNeinJa
Kommt mit Stereo-Hall zurechtNeinGrößtenteils
Kommt mit breit verteiltem Backgroundgesang zurechtNeinGrößtenteils
AusgabeNur Instrumental in MonoGesang und Instrumental in Stereo
Spezielle Software nötigNeinJa (Online-Tool, Plug-in oder App)
Typisches ErgebnisHohl, Gesang nur teilweise entferntSauber, gelegentlich leichte Artefakte

Wie gut sind KI-Vocal-Remover 2026?

Forscher messen die Trennqualität mit dem SDR (Signal-to-Distortion Ratio) in Dezibel – auf einem Standard-Testdatensatz aus 50 Songs namens MUSDB18-HQ. Höher ist besser, und alle 3 dB halbiert sich der verbleibende Fehler ungefähr.

So hat sich die Gesangsspur bei bekannten Modellen verbessert:

Balkendiagramm der Qualität der Gesangstrennung (SDR) für die Modelle Demucs, Band-Split RNN und BS-RoFormer

ModellEntwickelt vonJahrSDR GesangQuelle
SpleeterDeezer2019~5,9 dB (Durchschnitt aller Stems)Vergleich in der Demucs-README
Hybrid Transformer DemucsMeta AI20228,93 dBarXiv:2211.08553
HT Demucs, feinabgestimmtMeta AI20229,20 dBarXiv:2211.08553
Band-Split RNNLuo & Yu202210,47 dBangegeben in arXiv:2211.08553
BS-RoFormer (ohne zusätzliche Daten)ByteDance202310,66 dBarXiv:2309.02612
BS-RoFormer (+500 Songs)ByteDance202312,72 dBarXiv:2309.02612

Das Fazit: Innerhalb eines einzigen Forschungsjahres (2022 bis 2023) stiegen die besten veröffentlichten Gesangswerte von etwa 9–10,5 dB auf 12,7 dB. Genau diese Modelle oder enge Verwandte laufen heute in kostenlosen und günstigen Tools.

📝 Hinweis: Benchmark-Werte sind Durchschnittswerte. Ein sparsam arrangierter Akustiksong lässt sich besser trennen als ein dichtes, stark komprimiertes Rock-Master – egal, welches Modell Sie verwenden.


Methode 1: Gesang online mit einem KI-Vocal-Remover entfernen

Am besten für: alle, die in etwa einer Minute ein sauberes Instrumental wollen – am Computer oder auf dem Smartphone.

Mit dieser Methode sollten Sie anfangen. Es gibt nichts zu installieren, Sie brauchen keine GPU, und Sie hören sofort, ob das Ergebnis gut genug ist, bevor Sie Zeit in etwas anderes investieren.

Vier Schritte, um Gesang online zu entfernen: hochladen, trennen, anhören, herunterladen

Schritt 1: Audiodatei vorbereiten

Gute Quelle, gutes Ergebnis. Vor dem Hochladen:

  • Nehmen Sie die beste Quelle, die Sie haben. WAV oder FLAC schlägt MP3. Eine MP3 mit 320 kbps schlägt eine mit 128 kbps.
  • Verzichten Sie auf Bildschirmaufnahmen und über Lautsprecher neu aufgenommenes Audio. Raumhall und die Klangfärbung von Lautsprechern verwirren das Modell.
  • Schneiden Sie Stille oder lange Intros weg, wenn Ihre Datei nahe an der Längengrenze liegt.

Unterstützte Formate und Grenzen

EinstellungAnySpeech Vocal Remover
Unterstützte FormateMP3, WAV, FLAC, M4A (dazu OGG und AAC)
Max. Dateigröße50 MB
Max. Länge10 Minuten pro Song
AusgabeGesang und Instrumental, beide als MP3
Kostenloser Plan1 Song pro Tag mit kostenlosem Konto
Bezahlte Nutzung500 Credits pro Audiominute

Videodateien werden nicht direkt angenommen. Exportieren Sie zuerst die Tonspur als MP3.

Schritt 2: Hochladen und Trennung starten

  1. Öffnen Sie den KI-Vocal-Remover.
  2. Ziehen Sie Ihre Datei in den Upload-Bereich oder tippen Sie auf dem Smartphone auf Upload a File (Datei hochladen).
  3. Klicken Sie auf Remove Vocals (Gesang entfernen).

Ein typischer dreiminütiger Song ist in etwa einer Minute fertig. Längere Tracks brauchen ungefähr proportional länger.

Schritt 3: Beide Stems anhören

Laden Sie nicht sofort herunter. Spielen Sie beide Spuren auf der Seite ab und hören Sie an den zwei Stellen genau hin, an denen Probleme zuerst auffallen:

Wo Sie hinhören sollten

  • Der lauteste Refrain. In dichten Passagen verstecken sich schwache Gesangsreste im Instrumental.
  • Die leiseste Strophe. Sparsame Passagen legen „wässrige“ Artefakte im Instrumental offen.

Klingt beides sauber, sind Sie fertig. Wenn nicht, springen Sie zum Abschnitt zur Fehlerbehebung.

Schritt 4: Herunterladen, was Sie brauchen

Laden Sie das Instrumental für Karaoke oder zum Üben herunter, das Acapella für Remixe oder die Arbeit am Songtext – oder beides. Kostenlose Konten erhalten beide Stems in voller Länge, keine 30-Sekunden-Vorschau.

Weitere beliebte Online-Vocal-Remover

Die meisten Online-Tools nutzen ähnliche Modellfamilien. Die praktischen Unterschiede liegen bei den kostenlosen Kontingenten, den Längenbegrenzungen und der Zahl der Stems.

ToolKostenloser Plan (Stand: September 2026)StemsHinweise
AnySpeech1 Song/Tag, bis 10 Min.2Dasselbe Konto deckt auch Sprachisolierung, Transkription und TTS ab
LALAL.AIBegrenzte FreiminutenVerschiedene Stem-TypenStarke Qualität; bezahlte Minutenpakete
Moises5 Uploads/Monat, je 5 Min.2–6 (kostenpflichtig)Auch als iOS- und Android-App
BandLab SplitterKostenlos, Dateien bis 15 Min.4Erfordert ein BandLab-Konto
VocalRemover.orgKostenlos mit Werbung2Schnelle einmalige Trennungen

Kostenlose Kontingente ändern sich oft – prüfen Sie daher die Preisseite des jeweiligen Tools, bevor Sie sich auf eine Grenze verlassen. Einen ausführlicheren direkten Vergleich finden Sie in unserer Übersicht der besten Tools zur Audio-Isolierung.


Methode 2: Gesang in Audacity entfernen (kostenlos)

Am besten für: alle, die Audio ohnehin in Audacity bearbeiten und einen kostenlosen Offline-Workflow wollen.

Audacity ist der meistgesuchte Weg – und zugleich der am häufigsten missverstandene. Es gibt drei verschiedene Ansätze, und die meisten älteren Anleitungen behandeln nur den schwächsten davon.

Option A: Das KI-Plug-in Music Separation (empfohlen)

Intel stellt kostenlos die OpenVINO AI plugins for Audacity bereit. Eines davon, Music Separation, führt ein Demucs-v4-Modell lokal auf Ihrem Rechner aus.

So erhalten Sie Stems in KI-Qualität, ohne etwas hochzuladen.

So installieren Sie es

  1. Rufen Sie die offizielle Download-Seite von Audacity auf und suchen Sie den Abschnitt OpenVINO AI plugins.
  2. Laden Sie die Version herunter, die zu Ihrer Audacity-Version und Ihrem Betriebssystem passt.
  3. Führen Sie das Installationsprogramm aus und starten Sie Audacity neu.
  4. Öffnen Sie Effect › Plugin Manager und stellen Sie sicher, dass die OpenVINO-Effekte aktiviert sind.

📝 Hinweis: Das Plug-in ist für bestimmte Audacity-Versionen gebaut. Taucht es nach der Installation nicht auf, prüfen Sie die Kompatibilitätshinweise auf der Download-Seite. Für eine brandneue Audacity-Version erscheint das passende Plug-in manchmal etwas später.

So trennen Sie den Gesang ab

  1. Öffnen Sie Ihren Song in Audacity (File › Open).
  2. Markieren Sie die gesamte Spur mit Ctrl+A (bzw. Cmd+A auf dem Mac).
  3. Gehen Sie zu Effect › OpenVINO AI Effects › OpenVINO Music Separation.
  4. Stellen Sie Separation Mode (Trennmodus) auf (2 Stem) Instrumental, Vocals.
  5. Wählen Sie ein Gerät: GPU oder NPU, sofern vorhanden, andernfalls CPU.
  6. Klicken Sie auf Apply (Anwenden) und warten Sie. Das dauert meist ein bis drei Minuten.
  7. Audacity legt für jeden Stem eine neue Spur an. Schalten Sie die Gesangsspur stumm oder löschen Sie sie.
  8. Exportieren Sie das Instrumental über File › Export Audio.

2-Stem- und 4-Stem-Modus im Vergleich

ModusAusgabespurenSinnvoll, wenn
2 StemsInstrumental, GesangSie nur den Gesang entfernen wollen. Das ist sauberer und schneller.
4 StemsSchlagzeug, Bass, Gesang, SonstigesSie die Instrumente neu ausbalancieren oder einen Übungsmix bauen wollen.

Option B: Der Effekt Vocal Reduction and Isolation

Das ist der klassische Effekt, den die meisten Audacity-Anleitungen beschreiben. Er basiert auf der Auslöschung des Mittenkanals, nicht auf KI – rechnen Sie also mit den oben beschriebenen Grenzen.

Wichtig: Seit Audacity 3.5 ist dieser Effekt nicht mehr in der Standardinstallation enthalten. Sie müssen ihn von der Plug-in-Seite von Audacity herunterladen, über Tools › Nyquist Plugin Installer installieren und im Plugin Manager aktivieren.

So verwenden Sie ihn

  1. Markieren Sie den gesamten Song.
  2. Gehen Sie zu Effect › Special › Vocal Reduction and Isolation.
  3. Stellen Sie Action (Aktion) auf Remove Vocals.
  4. Passen Sie die Einstellungen unten an, klicken Sie auf Preview (Vorhören) und dann auf Apply.

Die Einstellungen erklärt

EinstellungStandardwertWas sie bewirktWann Sie sie ändern sollten
Strength1,0Wie aggressiv mittig liegendes Audio entfernt wirdLeicht erhöhen, wenn Gesang übrig bleibt; senken, wenn der Mix hohl klingt
Low Cut for Vocals120 HzFrequenzen darunter bleiben unangetastetHält Bass und Kickdrum intakt – also nicht deutlich erhöhen
High Cut for Vocals9.000 HzFrequenzen darüber bleiben unangetastetSenken, damit Becken und Hi-Hats brillant bleiben

Option C: Die manuelle Invertierungsmethode

Sie erledigt dieselbe Aufgabe von Hand. Nützlich ist das vor allem, um das Prinzip zu verstehen, oder auf einem Rechner, auf dem Sie keine Plug-ins installieren können.

  1. Klicken Sie auf das Menü am Spurnamen und wählen Sie Split Stereo to Mono.
  2. Markieren Sie nur die untere Spur.
  3. Gehen Sie zu Effect › Special › Invert.
  4. Markieren Sie beide Spuren und wählen Sie Tracks › Mix › Mix and Render.

Das Ergebnis ist eine einzelne Mono-Spur, in der alle mittig liegenden Anteile ausgelöscht sind.

Die Audacity-Optionen im Vergleich

KI-Plug-inEffekt Vocal ReductionManuelle Invertierung
TechnikKI (Demucs v4)Mittenauslöschung + EQ-BänderPhasenauslöschung
Bass und Schlagzeug bleiben erhaltenJaTeilweiseNein
Funktioniert mit Mono-DateienJaNeinNein
Stereo-AusgabeJaJaNein
Zusätzlicher DownloadJaJa (seit 3.5)Nein

Methode 3: Ultimate Vocal Remover nutzen (kostenlose Desktop-App)

Am besten für: Fortgeschrittene, die die höchste kostenlose Qualität, volle Kontrolle über die Modelle und unbegrenzte Stapelverarbeitung wollen.

Ultimate Vocal Remover (UVR) ist eine kostenlose Open-Source-Desktop-App für Windows, macOS und Linux. Sie ist eine grafische Oberfläche für zahlreiche Trennungsmodelle, darunter Demucs, MDX-Net und die neuere Roformer-Familie.

Was Sie brauchen

VoraussetzungEmpfehlung
BetriebssystemWindows 10/11, macOS oder Linux
GPUEine NVIDIA-Karte beschleunigt die Verarbeitung enorm. Macs mit Apple Silicon werden unterstützt.
Nur CPUFunktioniert, aber ein einzelner Song kann mehrere Minuten dauern
SpeicherplatzEinige GB, da jedes heruntergeladene Modell Platz belegt
VorkenntnisseSie sollten sich zutrauen, Modelle und Einstellungen selbst zu wählen

So entfernen Sie Gesang mit UVR

  1. Laden Sie UVR aus dem offiziellen GitHub-Repository herunter und installieren Sie es.
  2. Klicken Sie auf Select Input und wählen Sie Ihren Song.
  3. Wählen Sie einen Ausgabeordner.
  4. Wählen Sie eine Process Method (siehe Tabelle unten).
  5. Wählen Sie im Drop-down-Menü ein Modell. Ist es nicht installiert, laden Sie es über das Download-Center herunter.
  6. Setzen Sie das Häkchen bei GPU Conversion, wenn Sie eine unterstützte Grafikkarte haben.
  7. Wählen Sie Ausgabeoptionen wie Instrumental Only oder Vocals Only und klicken Sie auf Start Processing.

Welche Modellfamilie Sie wählen sollten

Process MethodStärkenSchwächen
Roformer-Modelle (z. B. BS-Roformer)Derzeit mit die saubersten Trennungen von Gesang und InstrumentalRechenintensiver; ohne GPU langsam
MDX-NetSauberer Gesang, guter AllrounderKann bei dichten Mixen leichte Artefakte hinterlassen
Demucs v4Natürlicher Klang, kann mehrere Stems trennenGeht mit Backgroundgesang gelegentlich weniger konsequent um
VR ArchitectureSchnell; enthält De-Echo- und De-Reverb-ModelleÄlterer Ansatz für die Haupttrennung

Ein Workflow in zwei Durchgängen für schwierige Songs

Der größte Vorteil von UVR ist die Verkettung von Modellen:

  1. Trennen Sie den Song mit einem starken Gesangsmodell (Roformer oder MDX-Net).
  2. Lassen Sie ein De-Reverb- oder De-Echo-Modell über das Instrumental laufen, um restlichen Gesangshall zu entfernen.

Das ist etwas anderes, als dieselbe Trennung zweimal durchzuführen – das macht die Sache meist schlimmer. Mehr dazu in der Fehlerbehebung.


Methode 4: Den integrierten Stem-Splitter Ihrer DAW nutzen

Am besten für: Produzenten, die bereits Logic Pro, Ableton Live Suite oder FL Studio besitzen.

Stem-Trennung ist inzwischen eine Standardfunktion in DAWs. Wenn Sie ohnehin für eine davon bezahlen, brauchen Sie womöglich gar kein weiteres Tool.

Stem-Splitter der DAWs im Vergleich

DAWName der FunktionStemsVoraussetzungen
Logic ProStem SplitterGesang, Schlagzeug, Bass, Sonstiges (neuere Versionen ergänzen Gitarre und Klavier)Logic Pro 11 oder neuer auf einem Mac mit Apple Silicon oder Logic Pro für iPad
Ableton LiveSeparate StemsGesang, Schlagzeug, Bass, SonstigesLive 12.3 oder neuer, nur in der Suite-Edition
FL StudioExtract stems from sampleGesang, Schlagzeug, Bass, InstrumenteFL Studio 21.2 oder neuer, ab Producer Edition

So geht es in Logic Pro

  1. Ziehen Sie den Song auf eine Audiospur.
  2. Markieren Sie die Region.
  3. Klicken Sie bei gedrückter Control-Taste auf die Region und wählen Sie Processing › Stem Splitter.
  4. Wählen Sie ein Preset oder markieren Sie die gewünschten Stems und starten Sie die Trennung.
  5. Schalten Sie die Gesangsspur stumm und bouncen Sie den Rest.

So geht es in Ableton Live 12.3+

  1. Ziehen Sie den Song auf eine Audiospur.
  2. Klicken Sie mit der rechten Maustaste auf den Clip und wählen Sie Separate Stems to New Audio Tracks.
  3. Markieren Sie die gewünschten Stems und wählen Sie High Quality (High Speed nur für schnelle Vorschauen).
  4. Die Stems landen in einer farbcodierten Gruppe. Deaktivieren Sie die Gesangsspur und exportieren Sie den Rest.

So geht es in FL Studio

  1. Ziehen Sie den Song in die Playlist oder das Channel Rack.
  2. Klicken Sie in der Playlist mit der rechten Maustaste auf den Audioclip und wählen Sie Extract stems from sample. Beim ersten Mal lädt FL Studio das Modell kostenlos herunter.
  3. Wählen Sie je nach Bedarf Schlagzeug, Bass, Instrumente und Gesang. Jeder Stem landet auf einer eigenen Spur.
  4. Schalten Sie den Gesang stumm und rendern Sie den Rest.

💡 Profi-Tipp: Menünamen ändern sich von Update zu Update. Wenn Sie die Option nicht finden, suchen Sie in der Hilfe Ihrer DAW nach „stem separation“. Der Ablauf ist überall nahezu gleich.


Methode 5: Gesang auf dem iPhone oder Android-Smartphone entfernen

Am besten für: Musiker, die unterwegs üben, oder alle, die gerade keinen Computer zur Hand haben.

Option A: Ein Browser-Tool nutzen (keine App nötig)

Webbasierte Vocal Remover funktionieren auch im mobilen Safari und in Chrome.

  1. Speichern Sie den Song in der Dateien-App (iPhone) oder im Download-Ordner (Android).
  2. Öffnen Sie den Vocal Remover in Ihrem Browser.
  3. Tippen Sie auf Upload a File und wählen Sie den Song.
  4. Tippen Sie auf Remove Vocals und spielen Sie die Stems anschließend ab oder laden Sie sie herunter.

Option B: Eine spezielle App nutzen

AppPlattformenKostenloser PlanBesonderheit
MoisesiOS, Android, Web5 Uploads/Monat, je 5 Min.Tonhöhe, Tempo und Akkorderkennung zum Üben
BandLabiOS, Android, WebKostenlosDer Splitter speist direkt in BandLabs mobiles Studio ein
Logic Pro für iPadiPadOSAboVollwertiger Stem Splitter für unterwegs

Option C: Gesang beim Streaming leiser stellen

Wenn Sie nur mitsingen wollen, müssen Sie womöglich gar nichts trennen.

Mit Apple Music Sing können Abonnenten von Apple Music bei unterstützten Songs den Gesang live leiser drehen – mit Songtext in Echtzeit. Das Instrumental können Sie nicht herunterladen, aber für Karaoke zu Hause ist es sofort verfügbar und vollständig lizenziert.


Bonus: Ein Acapella aus einem offiziellen Instrumental gewinnen

Manchmal wollen Sie genau das Gegenteil: den Gesang ohne die Musik.

Haben Sie sowohl den kompletten Song als auch sein offizielles Instrumental, gibt es einen cleveren Trick.

So funktioniert es

Der komplette Mix ist „Instrumental + Gesang“. Ziehen Sie das Instrumental ab, bleibt nur der Gesang übrig.

  1. Laden Sie beide Dateien untereinander in Audacity.
  2. Invertieren Sie das Instrumental (Effect › Special › Invert).
  3. Richten Sie beide Spuren am Anfang exakt aufeinander aus.
  4. Spielen Sie den Mix ab oder exportieren Sie ihn. Übrig bleibt nur der Gesang.

Wann es nicht klappt

ProblemUrsache
Musik ist weiterhin hörbarDie beiden Dateien stammen von unterschiedlichen Masters oder haben eine unterschiedliche Lautheit
Seltsamer Flanging-EffektDie Spuren sind um ein paar Samples gegeneinander verschoben
Funktioniert überhaupt nichtEine der Dateien ist eine verlustbehaftete MP3, was die Wellenform verändert

Scheitert der Trick, liefert Ihnen ein KI-Vocal-Remover allein aus dem kompletten Song ein saubereres Acapella.


So beheben Sie ein schlechtes Ergebnis beim Entfernen von Gesang

Selbst die besten Modelle stolpern bei manchen Songs. Die gute Nachricht: Die meisten Probleme haben eine klare Ursache und eine schnelle Lösung.

Sechs häufige Probleme beim Vocal Remover mit Ursachen und Lösungen

Problem 1: Geistergesang im Refrain

Was Sie hören: leise Harmonien oder gedoppelten Gesang in den lautesten Passagen.

Ursache: Backgroundgesang ist oft breit im Panorama verteilt und stark bearbeitet, sodass er für das Modell eher wie ein Instrument wirkt.

So beheben Sie es:

  • Probieren Sie ein anderes Modell. Roformer-basierte Modelle erfassen Backgroundspuren besonders zuverlässig.
  • Setzen Sie nur im Refrain eine sanfte EQ-Absenkung im Bereich von 1–4 kHz.
  • Nehmen Sie für Karaoke eine leichte Spur in Kauf. Ein Live-Sänger überdeckt sie vollständig.

Problem 2: Ein Echo der Stimme bleibt zurück

Was Sie hören: eine verwaschene Hall-Fahne nach jeder Gesangsphrase.

Ursache: Hall und Delay verteilen den Gesang zeitlich und im Stereoraum, sodass ein Teil davon als „Raum“ statt als „Stimme“ eingestuft wird.

So beheben Sie es:

  • Lassen Sie ein De-Reverb- oder De-Echo-Modell über das Instrumental laufen (UVR bringt mehrere mit).
  • Bei kurzen Pausen helfen auch ein Noise Gate oder eine sorgfältige Lautstärkeautomation.

Problem 3: Das Instrumental klingt „wässrig“

Was Sie hören: einen wabernden Unterwasser-Klang bei Becken, Flächen oder Gitarren.

Ursache: Das Modell ist dort unsicher, wo sich Stimme und Instrumente Frequenzen teilen. MP3s mit niedriger Bitrate verschlimmern das, weil die Kompression genau diese Details bereits verwischt hat.

So beheben Sie es:

  • Starten Sie erneut mit einer WAV-, FLAC- oder 320-kbps-Datei.
  • Verwenden Sie den 2-Stem-Modus statt 4 oder 6 Stems.
  • Probieren Sie eine andere Modellfamilie.

Warum die Qualität der Quelle so viel ausmacht

QuelldateiZu erwartendes Ergebnis
WAV / FLAC (verlustfrei)Sauberste Trennung
MP3 320 kbps / AAC 256 kbpsSehr nah an verlustfrei
MP3 128 kbpsHörbare Artefakte bei Becken und Hall
Bildschirmaufnahme, über Lautsprecher neu aufgenommenSchwach; der Raumklang verwirrt das Modell

Problem 4: Schlagzeug und Bass sind verschwunden

Ursache: Sie haben die Phasenauslöschung verwendet, die alles entfernt, was in der Mitte des Panoramas liegt.

Lösung: Wechseln Sie zu einer der oben beschriebenen KI-Methoden.

Problem 5: Es hat sich gar nichts geändert

Ursache: Die Datei ist mono (häufig bei alten Aufnahmen und manchen YouTube-Rips). Es gibt keinen Stereo-Unterschied, den die Auslöschung nutzen könnte.

Lösung: Bei Mono-Dateien funktioniert nur die KI-Trennung.

Problem 6: Nach einem zweiten Durchgang wurde es schlimmer

Ursache: Jede Trennung fügt winzige Artefakte hinzu. Schicken Sie ein Instrumental erneut durch dasselbe Modell, summieren sie sich.

Lösung: Trennen Sie immer vom Originalsong aus. Brauchen Sie zusätzliche Bereinigung, nehmen Sie eine andere Art von Modell, etwa De-Reverb, statt dasselbe zu wiederholen.


Was können Sie mit den getrennten Stems anfangen?

Sobald Sie saubere Stems haben, eröffnen sich viele Projekte.

Einsatzmöglichkeiten für das Instrumental

  • Karaoke: Singen Sie zum Originalarrangement statt zu einer billigen MIDI-Version.
  • Instrumente üben: Spielen Sie mit der kompletten Band – nur ohne den Part, den Sie gerade lernen.
  • Cover-Aufnahmen: Proben Sie Ihre eigene Gesangsaufnahme zum echten Playback.
  • Hintergrundmusik für private Projekte: Diashows, Familienvideos oder Referate, die Sie nicht veröffentlichen.

Einsatzmöglichkeiten für das Acapella

  • Remixe und Mashups: das Rohmaterial für DJs und Produzenten (lesen Sie die rechtlichen Hinweise unten, bevor Sie etwas veröffentlichen).
  • Gesangsstudium: Hören Sie Phrasierung, Atmer und Harmonien, die im kompletten Mix untergehen.
  • Songtexte transkribieren: Eine isolierte Gesangsspur lässt sich deutlich leichter transkribieren. Laden Sie das Acapella in ein Speech-to-Text-Tool hoch, um einen Entwurf des Songtexts mit Zeitstempeln zu erhalten.

Kein Song? Dann ist ein Voice Isolator das richtige Tool

Handelt es sich bei Ihrem Audio um einen Podcast, ein Interview oder ein Video mit Hintergrundgeräuschen statt um Musik, ist ein Vocal Remover das falsche Werkzeug. Ein Voice Isolator ist auf Sprache abgestimmt und entfernt Brummen, Verkehrslärm und Raumklang statt Instrumenten.

Und wenn Sie nur klarere Anrufe brauchen, hat Ihr Smartphone die Funktion womöglich schon eingebaut. So können Sie die Stimmisolierung aktivieren – auf iPhone, Mac und Android.


Den Gesang aus einem Song, den Sie rechtmäßig besitzen, für den privaten Gebrauch zu entfernen, ist in der Regel unproblematisch. Das Ergebnis zu veröffentlichen oder zu verkaufen, ist es meist nicht – es sei denn, Sie haben eine Erlaubnis.

Das Trennen einer Datei an sich ist selten das Problem. Entscheidend ist, was Sie anschließend mit den Stems machen.

Risikostufen für typische Nutzungen von Gesangs- und Instrumental-Stems – vom Üben zu Hause bis zur Veröffentlichung von Remixen

Warum Stems heikel sind

An einem veröffentlichten Song bestehen zwei getrennte Rechte:

  1. Die Komposition: Melodie und Text, deren Rechte bei den Songwritern und Musikverlagen liegen.
  2. Die Tonaufnahme: die konkret aufgenommene Darbietung, deren Rechte meist beim Plattenlabel liegen.

Ein extrahiertes Instrumental ist nach wie vor Teil der ursprünglichen Tonaufnahme. Selbst wenn Sie also eine Lizenz haben, einen Song zu covern, umfasst diese Lizenz in der Regel nicht die Nutzung der Aufnahme des Labels.

Nutzungsarten nach Risikostufe

Was Sie tunRisikoWarum
Zu Hause üben oder mitsingenGeringPrivate, nicht kommerzielle Nutzung
Einen Mix analysieren oder Songtexte für sich selbst transkribierenGeringPrivate, nicht kommerzielle Nutzung
Private Karaoke mit FreundenGeringKeine öffentliche Verbreitung
Ein Cover-Video zum extrahierten Instrumental postenMittelPlattformen können Ansprüche geltend machen, den Ton stummschalten oder das Video entfernen
Einen Remix oder ein Mashup auf Streamingdiensten veröffentlichenHochErfordert die Erlaubnis des Rechteinhabers der Aufnahme
Das Acapella in einem Track samplen, den Sie verkaufen oder monetarisierenHochErfordert die Klärung der Rechte an Aufnahme und Komposition

📝 Hinweis: Dies ist eine allgemeine Orientierung und keine Rechtsberatung. Das Urheberrecht unterscheidet sich von Land zu Land. Wenn Sie etwas veröffentlichen oder monetarisieren möchten, das auf der Aufnahme eines anderen Künstlers aufbaut, sprechen Sie mit einem auf Musikrecht spezialisierten Anwalt oder klären Sie das Sample vorher.

Sichere Alternativen für öffentliche Projekte

  • Lizenzieren Sie ein offizielles Instrumental oder eine offizielle Karaoke-Version.
  • Verwenden Sie lizenzfreie Playbacks.
  • Nehmen Sie Ihr eigenes Arrangement des Songs auf und lizenzieren Sie die Komposition als Cover.

Häufig gestellte Fragen

Kann ich den Gesang kostenlos aus einem Lied entfernen?

Ja. Zu den kostenlosen Optionen gehören Audacity mit Intels Plug-in OpenVINO Music Separation, die Desktop-App Ultimate Vocal Remover und Online-Tools mit kostenlosem Plan. Der Vocal Remover von AnySpeech gibt kostenlosen Konten einen Song pro Tag, bis zu 10 Minuten und 50 MB, und beide Stems lassen sich vollständig herunterladen.

Wie entfernt man Gesang aus einem Lied am besten?

Für die meisten bietet ein Online-KI-Vocal-Remover die beste Balance aus Qualität und Aufwand: hochladen, etwa eine Minute warten, herunterladen. Produzenten mit Logic Pro, Ableton Live Suite oder FL Studio können den integrierten Stem-Splitter nutzen. Fortgeschrittene, die maximale Kontrolle wollen, sollten Ultimate Vocal Remover mit einem Roformer-Modell ausprobieren.

Wie entferne ich Gesang aus einem Lied in Audacity?

Installieren Sie Intels kostenlose OpenVINO-KI-Plug-ins, markieren Sie den Song und wählen Sie Effect › OpenVINO AI Effects › OpenVINO Music Separation im 2-Stem-Modus. Der ältere Effekt Vocal Reduction and Isolation funktioniert weiterhin, arbeitet aber mit Mittenkanal-Auslöschung und ist seit Audacity 3.5 ein separater Download statt eines integrierten Effekts.

Warum höre ich nach dem Vocal Remover immer noch Gesang?

Meist handelt es sich um Backgroundgesang, Doppelungen oder Hall-Fahnen. Sie liegen breit im Panorama oder sind zeitlich verwischt, was ihre Zuordnung erschwert. Probieren Sie ein anderes Modell, starten Sie mit einer verlustfreien Datei und lassen Sie ein De-Reverb-Modell über das Instrumental laufen. Bei der Phasenauslöschung sind Gesangsreste zu erwarten – der Wechsel zur KI löst die meisten Fälle.

Kann man Gesang aus einem Mono-Song entfernen?

Nur mit KI-Trennung. Die Phasenauslöschung braucht einen Unterschied zwischen linkem und rechtem Kanal, und eine Mono-Datei hat keinen – die Auslöschung bewirkt also entweder nichts oder löscht den ganzen Song. KI-Modelle orientieren sich am Klang der Stimme, nicht an ihrer Position im Stereobild, deshalb lassen sich Mono-Aufnahmen problemlos trennen.

Verschlechtert das Entfernen von Gesang die Audioqualität?

Leicht. Selbst die besten Modelle hinterlassen schwache Artefakte, am deutlichsten hörbar bei Becken, Hall und lang gehaltenen Flächen. Mit einer WAV-, FLAC- oder 320-kbps-MP3-Datei als Ausgangsmaterial halten Sie sie minimal. Dichte, stark komprimierte Masters zeigen mehr Artefakte als sparsam arrangierte oder akustische Songs.

Wie bekomme ich nur den Gesang (Acapella) aus einem Song?

Nutzen Sie dieselben Tools und laden Sie statt des Instrumentals die Gesangsspur herunter. Jede Methode in diesem Leitfaden liefert beides. Haben Sie bereits das offizielle Instrumental, können Sie es auch invertiert gegen den kompletten Song laufen lassen, um die Musik auszulöschen – allerdings nur, wenn beide Dateien vom selben Master stammen.

Kann ich auf dem iPhone Gesang aus einem Lied entfernen?

Ja. Öffnen Sie einen browserbasierten Vocal Remover in Safari und laden Sie den Song aus der Dateien-App hoch, oder installieren Sie eine App wie Moises oder BandLab. Wenn Sie nur mitsingen wollen, kann Apple Music Sing den Gesang bei unterstützten Songs leiser stellen, ohne eine Datei zu erzeugen.

Kann ich Gesang aus einem YouTube-Video entfernen?

Nur, wenn Sie die Rechte an dem Audio haben. Laden Sie die Tonspur auf legalem Weg herunter oder exportieren Sie sie (zum Beispiel Ihre eigenen Uploads aus YouTube Studio), speichern Sie sie als MP3 oder WAV und lassen Sie sie anschließend durch einen Vocal Remover laufen. Die meisten Online-Vocal-Remover akzeptieren Audiodateien, keine Videolinks oder Videodateien.

Wie lange dauert es, Gesang aus einem Lied zu entfernen?

Mit einem Online-KI-Tool dauert ein dreiminütiger Song rund eine Minute. Das KI-Plug-in für Audacity braucht auf einem modernen Rechner meist ein bis drei Minuten. Ultimate Vocal Remover ist mit einer starken NVIDIA-GPU in Sekunden fertig, kann allein auf der CPU aber mehrere Minuten benötigen.


Das Fazit

Gesang aus einem Lied zu entfernen, war früher ein Partytrick, der nur halb funktionierte. Die KI-Trennung hat daraus eine zuverlässige Aufgabe von einer Minute gemacht.

So gehen Sie am einfachsten vor:

  1. Starten Sie online. Laden Sie einen Song in einen KI-Vocal-Remover hoch und hören Sie sich den Refrain an.
  2. Wechseln Sie bei Bedarf auf lokale Tools. Nutzen Sie das KI-Plug-in für Audacity oder Ultimate Vocal Remover für Offline- oder Massenverarbeitung.
  3. Nutzen Sie Ihre DAW, wenn Sie ohnehin in Logic, Ableton oder FL Studio produzieren.
  4. Füttern Sie das Tool mit gutem Audio. Eine verlustfreie Quelle löst mehr Probleme als ein Tool-Wechsel.
  5. Bleiben Sie im privaten Rahmen, sofern Sie keine Erlaubnis für die Aufnahme haben.

Bereit, es auszuprobieren? Laden Sie einen Song in den kostenlosen KI-Vocal-Remover hoch und erhalten Sie in etwa einer Minute Acapella und Instrumental. Keine Kreditkarte nötig.

Arbeiten Sie auch jenseits von Musik mit Stimmen, lesen Sie unseren Leitfaden, wie Sie Audio in Text umwandeln, oder vergleichen Sie die Optionen in unserer Übersicht der besten Tools zur Audio-Isolierung.

Autor

avatar for AnySpeech Team
AnySpeech Team

Kategorien

Welche Methode ist die richtige für Sie?Die 5 Methoden im ÜberblickSchnell entscheidenVorab: So funktioniert das Entfernen von Gesang wirklichWas bedeutet „Gesang entfernen“?Methode A: Phasenauslöschung (der alte Trick)So funktioniert esWarum das Ergebnis meist enttäuschtMethode B: KI-Quellentrennung (der moderne Weg)So funktioniert esPhasenauslöschung und KI im VergleichWie gut sind KI-Vocal-Remover 2026?Methode 1: Gesang online mit einem KI-Vocal-Remover entfernenSchritt 1: Audiodatei vorbereitenUnterstützte Formate und GrenzenSchritt 2: Hochladen und Trennung startenSchritt 3: Beide Stems anhörenWo Sie hinhören solltenSchritt 4: Herunterladen, was Sie brauchenWeitere beliebte Online-Vocal-RemoverMethode 2: Gesang in Audacity entfernen (kostenlos)Option A: Das KI-Plug-in Music Separation (empfohlen)So installieren Sie esSo trennen Sie den Gesang ab2-Stem- und 4-Stem-Modus im VergleichOption B: Der Effekt Vocal Reduction and IsolationSo verwenden Sie ihnDie Einstellungen erklärtOption C: Die manuelle InvertierungsmethodeDie Audacity-Optionen im VergleichMethode 3: Ultimate Vocal Remover nutzen (kostenlose Desktop-App)Was Sie brauchenSo entfernen Sie Gesang mit UVRWelche Modellfamilie Sie wählen solltenEin Workflow in zwei Durchgängen für schwierige SongsMethode 4: Den integrierten Stem-Splitter Ihrer DAW nutzenStem-Splitter der DAWs im VergleichSo geht es in Logic ProSo geht es in Ableton Live 12.3+So geht es in FL StudioMethode 5: Gesang auf dem iPhone oder Android-Smartphone entfernenOption A: Ein Browser-Tool nutzen (keine App nötig)Option B: Eine spezielle App nutzenOption C: Gesang beim Streaming leiser stellenBonus: Ein Acapella aus einem offiziellen Instrumental gewinnenSo funktioniert esWann es nicht klapptSo beheben Sie ein schlechtes Ergebnis beim Entfernen von GesangProblem 1: Geistergesang im RefrainProblem 2: Ein Echo der Stimme bleibt zurückProblem 3: Das Instrumental klingt „wässrig“Warum die Qualität der Quelle so viel ausmachtProblem 4: Schlagzeug und Bass sind verschwundenProblem 5: Es hat sich gar nichts geändertProblem 6: Nach einem zweiten Durchgang wurde es schlimmerWas können Sie mit den getrennten Stems anfangen?Einsatzmöglichkeiten für das InstrumentalEinsatzmöglichkeiten für das AcapellaKein Song? Dann ist ein Voice Isolator das richtige ToolIst es legal, Gesang aus einem Lied zu entfernen?Warum Stems heikel sindNutzungsarten nach RisikostufeSichere Alternativen für öffentliche ProjekteHäufig gestellte FragenKann ich den Gesang kostenlos aus einem Lied entfernen?Wie entfernt man Gesang aus einem Lied am besten?Wie entferne ich Gesang aus einem Lied in Audacity?Warum höre ich nach dem Vocal Remover immer noch Gesang?Kann man Gesang aus einem Mono-Song entfernen?Verschlechtert das Entfernen von Gesang die Audioqualität?Wie bekomme ich nur den Gesang (Acapella) aus einem Song?Kann ich auf dem iPhone Gesang aus einem Lied entfernen?Kann ich Gesang aus einem YouTube-Video entfernen?Wie lange dauert es, Gesang aus einem Lied zu entfernen?Das Fazit